Перейти к содержимому
9 августа 2026 г. · Платформа

Шесть команд агентов, один цикл

Эта статья описывает продукт на момент публикации. Актуальные возможности см. в разделах AI Builder и Agent Teams.

Шесть команд агентов, один цикл

Шесть команд агентов. Пять исследовательских агентов работают параллельно в каждом цикле Discovery. Три способа запустить каждую команду — один раз, по запросу или по расписанию, которое повторяется, пока вы не остановите его. И одна цифра, которую легко упустить: ноль кликов человека между тем, как баг переживёт два раунда проверки, и тем, как исправление реально попадёт в сборку.

Последний пункт как раз стоит того, чтобы объяснить, и обложка этого поста служит примером. Overgrowth Station — это idle-игра о восстановлении заброшенной транспортной станции, которую медленно поглощают лианы, а вы тратите валюту, чтобы их расчищать. Никто в нашей команде эту игру не придумывал — исследовательские агенты извлекли идею из скопления тредов на Reddit о «уютных менеджмент-играх без условия проигрыша», конструктор собрал рабочую версию примерно за сорок минут реального времени, а верификаторы обнаружили, что слой мира был полностью беззвучным, пока интерфейс пищал при каждом клике. Никто не заводил тикет по этому поводу. Платформа сама поставила в очередь повторный прогон с исправлением, следующий проход добавил недостающую фоновую озвучку, а пересобранная версия сегодня утром прошла полную цепочку проверки. В этом и заключается вся суть платформы, сжатая до одного скриншота: цикл, а не инструмент, где результат одной команды становится входными данными для следующей, а пробелы замечаются без того, чтобы кто-то следил за этим вручную.

Перед циклом исправлений есть цикл идей

Большинство AI-конструкторов начинают с текстового поля — вы приносите идею, они её строят. Это нормально, если вы уже знаете, что строить, но вопрос «что мне строить» — это исследовательская задача раньше, чем продуктовая, и на неё можно ответить, проделав определённую работу: что люди обсуждают в r/smallbusiness, что одиннадцать раз в неделю спрашивают на нишевом сабреддите, что находится в слоте «вам может понравиться» недостаточно охваченной категории App Store. Команда Discovery проделывает эту работу по расписанию. Пять агентов работают параллельно — данные о трендах, обсуждения в соцсетях, сайты вопросов и ответов вроде Quora и Stack Exchange, пробелы в категориях магазинов приложений, и пятый агент, который синтезирует: он читает то, что нашли остальные четыре, и ищет одну и ту же жалобу, всплывающую больше чем в одном месте, — обычно именно это отличает реальную возможность от единичного недовольства.

Они сходятся в так называемых Opportunity Brief, и такой брифинг — не просто ощущение: он называет проблему словами, которые реально использовали люди, оценивает размер аудитории, ссылается на доказательства (ссылки на треды, цитаты, объём поисковых запросов, если он есть) и очерчивает рамки MVP. Не «фитнес-приложение», а «счётчик повторений для конкретной категории упражнений короче 40 секунд, для которой никто ещё не сделал нормальный таймер». Нажмите Build-this, и именно этот сформулированный объём становится промптом для конструктора, без потерь при передаче. Всё это можно пропустить и ввести свою идею, и большинство людей поначалу так и делают — Discovery начинает окупать себя больше на втором или третьем продукте, когда собственные идеи заканчиваются.

Что на самом деле обнаружило беззвучное аудио

Команда конструктора сначала планирует, а потом уже трогает код. Вы получаете короткий письменный план, и она спросит о том, что не может угадать сама, — сохранения привязаны к устройству или к аккаунту, платный тариф с первого дня или пока только бесплатная версия. Если пропустить этот вопрос, можно получить конструктор, который ошибётся в чём-то, что дорого переделывать позже. После подтверждения он строит приложение, пока вы наблюдаете за живым обновлением предпросмотра. Охват широкий — сайты, веб-приложения с настоящими бэкендами, 2D- и 3D-игры, Android-приложения, десктопные приложения, расширения браузера, — и он честен насчёт скорости: 3D-игры сходятся заметно медленнее, чем обычное CRUD веб-приложение, и об этом говорится заранее, а не молча, спустя время, в три раза дольше ожидаемого.

Отсутствие звука в Overgrowth Station заметил вовсе не билдер. Отдельная группа агентов-верификаторов — не тот же агент, что проверяет собственную домашнюю работу, — проверяет код на корректность, аудирует его на предмет уязвимостей (инъекции, утечки секретов, маршруты без проверки авторизации), ищет битые ссылки и базовые проблемы с SEO, прогоняет тесты доступности на итоговом результате и убеждается, что сборка действительно соответствует плану. Последняя проверка существует потому, что билдер может выдать технически рабочий код, который незаметно теряет функцию, обещанную планом, если она оказалась сложнее, чем ожидалось. Найденные проблемы возвращаются на доработку, и цикл проверяет результат заново, а не принимает исправление на веру. Если что-то всё же проходит мимо, следующий запланированный запуск подхватывает это позже — в случае с Overgrowth Station, спустя часы — без тикетов, напоминаний и без того, чтобы человек первым заметил пробел. Подробнее о том, как устроена сама цепочка, — в статье Как сборки проверяют сами себя.

Публикация без передачи вас реселлеру

Готовая сборка публикуется на бесплатном поддомене в один клик, разворачивается на вашем собственном сервере по SFTP или отправляется в магазины приложений через ваши собственные аккаунты разработчика — ваш аккаунт Google Play, ваш аккаунт Apple, ваши ключи. Мы нигде не встаём посередине, а значит, аккаунт, доход и возможность уйти без потери приложения остаются за вами. Команда Ship берёт на себя всю рутину по упаковке: настоящий подписанный .aab через реальный набор инструментов Android, а не обёртку, подписанные установщики для десктопа, упакованные zip-файлы браузерных расширений, описания в магазинах и декларации конфиденциальности, составленные на основе того, что код действительно делает, а не по общему шаблону. Приложение, которое не работает с геоданными, не получит форму конфиденциальности, утверждающую обратное.

Две вещи остаются под вашим контролем намеренно, а не из-за ограничений: единовременный сбор за регистрацию разработчика и финальный клик публикации, который открывает доступ реальным пользователям. Мы могли бы автоматизировать оба этих шага с помощью сохранённых платёжных данных, но решили этого не делать — причины изложены во врезке ниже. Полный разбор, включая то, как выглядит отклонённая заявка, — в статье От промпта до магазина приложений.

То, что большинство инструментов вообще пропускают

Выпущенный продукт без обратной связи — это просто дорогой прототип, и на этом этапе большинство инструментов просто вручают вам URL и исчезают. Подключите Search Console и Analytics, и команда Optimize начнёт ежедневно вытягивать реальные цифры — по каким запросам вы ранжируетесь и на какой позиции, кто кликает, что делают пользователи после перехода на сайт. Для приложений те же дашборды подпитывает статистика магазинов (установки, удержание, частота сбоев). Это превращает пробелы в конкретные предложения, а не расплывчатые советы: «эта страница занимает 14-ю позицию по запросу с реальным объёмом трафика, тег title его не упоминает, вот вариант переработки». Выберите режим работы — команда может только отчитываться, предлагать изменения и ждать вашего одобрения, либо применять изменения самостоятельно и отслеживать, не пошли ли метрики не в ту сторону, с возможностью отката, если это произойдёт.

Команда Marketing готовит продвижение, которое естественно смотрится там, где публикуется, и это потребовало больше итераций, чем ожидалось. Ранние версии просто вставляли одни и те же три предложения в Reddit, X и ответ на Quora, и это было заметно. Теперь: пост для Reddit, настроенный под тон конкретного сабреддита, с запланированным ответом в первом комментарии, потому что на Reddit реальная информация часто находится именно в комментарии, а сам пост — лишь зацепка; тред в X, рассчитанный на читателя, который уйдёт после первой же неудачной строки; ответ на Quora, который сначала два абзаца учит чему-то полезному и только потом упоминает о существовании продукта. Команда Ads планирует кампании и готовит креативы — заголовки, изображения, таргетинг — для таких платформ, как Google Ads. Каждый черновик от обеих команд остаётся на ожидании вашего решения.

КомандаЧто он производитПередаёт эстафету
DiscoveryБрифы по возможностям с доказательствами и объёмом MVPСборка
BuilderПроверенные сборки: сайты, приложения, игры, нативные артефактыВыпуск
ShipОпубликованные URL, установщики, заявки в магазиныОптимизация
OptimizeИсправления на основе данных из реальных GSC / GA4 / статистики магазиновцикл
MarketingЧерновики постов, адаптированные под платформувы
AdsПланы кампаний и черновики креативоввы

Где цикл останавливается сам

Автономный режим связывает все шесть команд в цепочку, так что исследование питает сборку, сборка — публикацию, публикация — оптимизацию, и цикл повторяется по собственному расписанию без необходимости запускать каждый этап вручную. Мы сами используем этот цикл именно так, и большая часть того, что представлено в нашей витрине и Unity Lab, появилась именно в автономном режиме — никто не садился и не решал, что игра про восстановление заброшенных территорий должна существовать, пока не появилась Overgrowth Station.

Одно жёсткое правило. Ничто, что тратит деньги или публикуется от вашего имени, не происходит без вашего явного клика — в любом режиме. Рекламные бюджеты требуют вашего одобрения, посты в соцсетях выходят только тогда, когда вы это разрешите. Автономия распространяется на работу — исследование, сборку, проверку, черновики, — но не на ваш кошелёк или репутацию, и это не ограничение, которое мы планируем снять в будущем. Неверный автономный коммит кода исправляется и перепроверяется бесплатно. Неверная автономная трата на рекламу или неудачный автономный пост уже оказываются в реальном мире.
Платформа
ПоделитьсяXLinkedInFacebookRedditQuoraWhatsAppTelegramEmail
← Все статьи