и Factory

Forge и Factory

Droids в Factory уже умеют регулируемую автономность, выбор модели и кастомных субагентов — так что это не спор о недостающих фичах. Разница в том, что Forge ставит между ролями независимого управляющего агента и коммитит каждую передачу в ваш репозиторий, а ещё ведёт работу, которая вообще не про софт.

Субагенту делегируют, а роль Forge оценивают

Кастомные Droids в Factory — переиспользуемые субагенты со своим промптом, инструментами, моделью и уровнем автономности: ведущий агент вызывает такого и сам решает, хорош ли результат. В Forge независимый управляющий агент читает передачу и может вернуть её с инструкциями на доработку раньше, чем на ней начнут строить.

Разрешение до изменения — и запись о нём после

Явная модель разрешений в Factory даёт просмотреть каждое изменение до того, как оно коснётся кодовой базы, и это правильный контроль. Forge отвечает на другой вопрос: почему спустя месяцы это было сделано именно так. Спецификация, бриф и рассуждение каждой роли — коммиты в вашем репозитории.

Счёт, а не процент ROI

На enterprise-странице Factory приводятся кратности и проценты без опубликованной методики. Мы отвечаем счётом и его методикой: за двенадцать недель, пока Forge собирал Forge, управляющий агент оценил 1216 передач и остановил 80 из них. Без придуманной базы сравнения и без кратностей продуктивности.

Софт — это архетип, а не сам продукт

Factory — стек автономности для разработки. Тот же движок Forge ведёт команды ресёрча, контента и операций: роли разные, механика та же.

Что такое Factory — его собственными словами

Factory позиционирует себя как «THE INDUSTRIAL REVOLUTION FOR SOFTWARE DEVELOPMENT» и «THE AUTONOMY STACK FOR ENTERPRISE TEAMS». Его агенты — Droids: «Give Droids a task in natural language and they plan, write, test, and ship code». Продукт покрывает много поверхностей — «Terminal and IDE to collaborate. Browser, Slack, Jira to delegate. CLI to automate», работая «natively in VS Code, JetBrains, Vim, the browser, Slack, and the terminal», — причём «Droids keep their knowledge across tools and platforms». Контроль описан явно: раздел «Adjustable autonomy» обещает «From fully supervised to autonomous execution, you control the boundaries for edits, execution, and approvals», а «Secure by default» с «Explicit permission model» даёт «Review every modification before it touches your codebase». Модели не зафиксированы — «Choose Claude, GPT, Gemini, or any model per task», «No vendor lock-in». Enterprise-страница перечисляет SOC 2, ISO 42001, GDPR и CCPA, SSO/SAML, выделенные вычислительные ресурсы и нативные интеграции с GitHub, GitLab, Jira, Linear, Notion, Sentry, PagerDuty, Slack и другими. Кастомные Droids — переиспользуемые субагенты, описанные Markdown-файлами в .factory/droids/, у каждого «its own system prompt, tool policy, model, and autonomy level». (Источники: factory.ai , factory.ai/product/droids , factory.ai/enterprise .)

Выбор модели, регулируемая автономность, субагенты со своей политикой инструментов, запуск из Slack и Jira — всё это есть, так что чек-лист фич здесь ничего не решит.

Поэтому сравнение сводится к двум более узким вещам: кто судит передачу и где остаётся рассуждение.

Разница одной таблицей

FactoryForge
Единица агентаDroid; кастомные Droids — переиспользуемые субагенты со своим промптом, инструментами, моделью и уровнем автономностиИменованная роль в команде — продакт, архитектор, разработчик, тестировщик, ревьюер, исследователь, автор
Кто судит шагВызывающий агент, плюс вы — через модель разрешений, до того как изменение приземлитсяНезависимый управляющий агент на каждом ребре: пропустить, вернуть с инструкциями на доработку или эскалировать человеку
Когда происходит проверкаПрежде чем изменение коснётся кодовой базыМежду ролями, по результату работы, до того как на нём начнёт строить следующая роль, — и ещё раз на pull request
Отклонённый шагПовторный промпт или запрет измененияНовый коммит; предыдущая попытка остаётся в истории, git diff показывает, что изменилось
СледСессии и знание, переносимые между поверхностями FactoryВетка в вашем репозитории — спецификация, бриф и каждая передача коммитами, роль указана как Co-authored-by
Модели«Claude, GPT, Gemini, or any model per task»Шлюз маршрутизации по пулу провайдеров с весами приоритета и автоматическим failover, включая self-hosted модели
Где выполняетсяПлатформа Factory, с выделенными ресурсами для enterpriseУправляемый SaaS или self-hosted раннеры на вашем железе; тулчейн открыт
ОбластьРазработка ПОРазработка (самый зрелый архетип), а также ресёрч, контент и операции

В чём Forge устроен иначе

Независимый судья, а не мнение вызывающего. Кастомные Droids в Factory — цели делегирования: ведущий агент вызывает такого, получает результат и решает, что с ним делать. Forge вставляет на ребро отдельного управляющего агента, единственная задача которого — оценить передачу: пропустить, вернуть с конкретными инструкциями на доработку или эскалировать человеку. Разница проявляется тогда, когда ошибается как раз вызывающий агент. Подробнее: Multi-Agent Pipeline .

Разрешение и происхождение — разные контроли. «Review every modification before it touches your codebase» отвечает на вопрос «должно ли это изменение приземлиться». Оно не отвечает на вопрос «почему через полгода мы построили это так и против чего возражал ревьюер». Каждый прогон Forge оставляет ветку со спецификацией, исходным брифом и структурированной и свободной передачей каждой роли в виде коммитов, где автором записана роль, — читается через git log человеком, которого там не было. Подробнее: Git-Backed Audit .

Ваша инфраструктура и открытый тулчейн. Self-hosted раннеры оставляют исполнение на ваших машинах, а инференс маршрутизируется по пулу провайдеров, который контролируете вы, включая self-hosted модели и любой OpenAI-совместимый эндпоинт. Подробнее: Bring Your Own Hardware и Multi-Provider Routing .

Не только софт. Тот же движок, тот же цикл проверки и тот же аудит ведут команду ресёрча, которая проверяет собственные источники, контент-команду или дежурство в операциях — механика та же, роли другие. Смотрите сценарии .

Число, которое один агент показать не может

Enterprise-страница Factory рекламирует кратность ускорения поставки, процент сокращения времени миграции и процент сэкономленного времени дежурств — без размера выборки, базы сравнения и методики. Мы не станем отвечать на это своим процентом. Мы ответим счётом и тем, откуда он взялся.

Двенадцать недель, за которые Forge собирал Forge
Запущено прогонов322
Передач оценено управляющим агентом1216
Возвращено автору на доработку56
Эскалировано человеку24
Прогонов, где руководитель остановил хотя бы одну передачу51
Прогонов завершилось успешно215
Прогонов упало, эскалировано или отменено103
Медианное время от запуска до конца прогона39 минут
Медианное число передач на успешный прогон5
Влитых pull request в 7 репозиториях202

Откуда это взято. Один процесс — Main Forge SDLC, тот самый, который собирает Forge, — все его прогоны за двенадцать недель подряд, посчитанные по собственным записям управляющего контура. Не выборка, не пилот и не клиентский кейс, который мы не можем показать.

Forge останавливал собственную работу 80 раз. 56 передач вернулись автору с конкретными инструкциями на доработку, 24 ушли к человеку. Один прогон из шести прервал его собственный руководитель раньше, чем на работу посмотрел человек. Это ровно та проверка, которую инструмент с одним агентом оставляет вам, — здесь она стоит один вызов модели на ребро и посчитана.

За тот же период влито 202 pull request в 7 репозиториях — примерно 17 в неделю, в ту самую платформу, о которой вы читаете, причём каждое слияние делал человек. По всей организации работа, написанная агентами, влилась в 773 случаях из 875 открытых. Forge — не демо, работающее рядом с продуктом; это способ, которым продукт собирается, и это его коммиты.

Успешный прогон занимает примерно 39 минут и 5 передач. Медиана от запуска до завершения — и внутри этих 39 минут лежат проверки, которые не дали 80 результатам работы доехать до следующей роли в том виде, в каком они были написаны.

Обратите внимание, чего здесь нет: ни кратности продуктивности, ни сэкономленных часов. Чтобы их получить, пришлось бы придумать базу сравнения. Счёт того, что система сделала, в принципе проверяем; процент улучшения относительно неназванной альтернативы не проверяем никак — а у кастомного Droid, которого оценивает вызвавший его агент, попросту нет ребра, на котором можно было бы записать число вроде этих 56.

Попросите провести вас по самим прогонам — ветка, коммиты передач, вердикты, которые вернули работу назад, и те, что ушли к человеку. Любое другое число на этом сайте относится к конкретному прогону и так и подписано: 18 собранных источников, 11 проверенных прямым обращением, 4 подтверждённых перекрёстно и 2 помеченных как непроверяемые — на странице сценария .

Источники

  • factory.ai — позиционирование, имена клиентов.
  • factory.ai/product/droids — что такое Droid, регулируемая автономность, модель разрешений, выбор модели, поверхности.
  • factory.ai/enterprise — интеграции, стандарты соответствия, поддержка и обсуждаемые выше цифры ROI.
  • Утверждения о Forge на этой странице ведут на соответствующие страницы возможностей , где механика описана подробно.

Выбираете enterprise-стек автономности?

Попросите у обоих след аудита реального прогона. Forge предложит команду и дождётся вашего одобрения, прежде чем что-то потратить.