Что такое Factory — его собственными словами
Factory позиционирует себя как «THE INDUSTRIAL REVOLUTION FOR SOFTWARE DEVELOPMENT» и «THE AUTONOMY STACK FOR ENTERPRISE TEAMS». Его агенты — Droids: «Give Droids a task in natural language and they plan, write, test, and ship code». Продукт покрывает много поверхностей — «Terminal and IDE to collaborate. Browser, Slack, Jira to delegate. CLI to automate», работая «natively in VS Code, JetBrains, Vim, the browser, Slack, and the terminal», — причём «Droids keep their knowledge across tools and platforms». Контроль описан явно: раздел «Adjustable autonomy» обещает «From fully supervised to autonomous execution, you control the boundaries for edits, execution, and approvals», а «Secure by default» с «Explicit permission model» даёт «Review every modification before it touches your codebase». Модели не зафиксированы — «Choose Claude, GPT, Gemini, or any model per task», «No vendor lock-in». Enterprise-страница перечисляет SOC 2, ISO 42001, GDPR и CCPA, SSO/SAML, выделенные вычислительные ресурсы и нативные интеграции с GitHub, GitLab, Jira, Linear, Notion, Sentry, PagerDuty, Slack и другими. Кастомные Droids — переиспользуемые субагенты, описанные Markdown-файлами в .factory/droids/, у каждого «its own system prompt, tool policy, model, and autonomy level». (Источники: factory.ai
, factory.ai/product/droids
, factory.ai/enterprise
.)
Выбор модели, регулируемая автономность, субагенты со своей политикой инструментов, запуск из Slack и Jira — всё это есть, так что чек-лист фич здесь ничего не решит.
Поэтому сравнение сводится к двум более узким вещам: кто судит передачу и где остаётся рассуждение.
Разница одной таблицей
| Factory | Forge | |
|---|---|---|
| Единица агента | Droid; кастомные Droids — переиспользуемые субагенты со своим промптом, инструментами, моделью и уровнем автономности | Именованная роль в команде — продакт, архитектор, разработчик, тестировщик, ревьюер, исследователь, автор |
| Кто судит шаг | Вызывающий агент, плюс вы — через модель разрешений, до того как изменение приземлится | Независимый управляющий агент на каждом ребре: пропустить, вернуть с инструкциями на доработку или эскалировать человеку |
| Когда происходит проверка | Прежде чем изменение коснётся кодовой базы | Между ролями, по результату работы, до того как на нём начнёт строить следующая роль, — и ещё раз на pull request |
| Отклонённый шаг | Повторный промпт или запрет изменения | Новый коммит; предыдущая попытка остаётся в истории, git diff показывает, что изменилось |
| След | Сессии и знание, переносимые между поверхностями Factory | Ветка в вашем репозитории — спецификация, бриф и каждая передача коммитами, роль указана как Co-authored-by |
| Модели | «Claude, GPT, Gemini, or any model per task» | Шлюз маршрутизации по пулу провайдеров с весами приоритета и автоматическим failover, включая self-hosted модели |
| Где выполняется | Платформа Factory, с выделенными ресурсами для enterprise | Управляемый SaaS или self-hosted раннеры на вашем железе; тулчейн открыт |
| Область | Разработка ПО | Разработка (самый зрелый архетип), а также ресёрч, контент и операции |
В чём Forge устроен иначе
Независимый судья, а не мнение вызывающего. Кастомные Droids в Factory — цели делегирования: ведущий агент вызывает такого, получает результат и решает, что с ним делать. Forge вставляет на ребро отдельного управляющего агента, единственная задача которого — оценить передачу: пропустить, вернуть с конкретными инструкциями на доработку или эскалировать человеку. Разница проявляется тогда, когда ошибается как раз вызывающий агент. Подробнее: Multi-Agent Pipeline .
Разрешение и происхождение — разные контроли. «Review every modification before it touches your codebase» отвечает на вопрос «должно ли это изменение приземлиться». Оно не отвечает на вопрос «почему через полгода мы построили это так и против чего возражал ревьюер». Каждый прогон Forge оставляет ветку со спецификацией, исходным брифом и структурированной и свободной передачей каждой роли в виде коммитов, где автором записана роль, — читается через git log человеком, которого там не было. Подробнее: Git-Backed Audit
.
Ваша инфраструктура и открытый тулчейн. Self-hosted раннеры оставляют исполнение на ваших машинах, а инференс маршрутизируется по пулу провайдеров, который контролируете вы, включая self-hosted модели и любой OpenAI-совместимый эндпоинт. Подробнее: Bring Your Own Hardware и Multi-Provider Routing .
Не только софт. Тот же движок, тот же цикл проверки и тот же аудит ведут команду ресёрча, которая проверяет собственные источники, контент-команду или дежурство в операциях — механика та же, роли другие. Смотрите сценарии .
Число, которое один агент показать не может
Enterprise-страница Factory рекламирует кратность ускорения поставки, процент сокращения времени миграции и процент сэкономленного времени дежурств — без размера выборки, базы сравнения и методики. Мы не станем отвечать на это своим процентом. Мы ответим счётом и тем, откуда он взялся.
| Двенадцать недель, за которые Forge собирал Forge | |
|---|---|
| Запущено прогонов | 322 |
| Передач оценено управляющим агентом | 1216 |
| Возвращено автору на доработку | 56 |
| Эскалировано человеку | 24 |
| Прогонов, где руководитель остановил хотя бы одну передачу | 51 |
| Прогонов завершилось успешно | 215 |
| Прогонов упало, эскалировано или отменено | 103 |
| Медианное время от запуска до конца прогона | 39 минут |
| Медианное число передач на успешный прогон | 5 |
| Влитых pull request в 7 репозиториях | 202 |
Откуда это взято. Один процесс — Main Forge SDLC, тот самый, который собирает Forge, — все его прогоны за двенадцать недель подряд, посчитанные по собственным записям управляющего контура. Не выборка, не пилот и не клиентский кейс, который мы не можем показать.
Forge останавливал собственную работу 80 раз. 56 передач вернулись автору с конкретными инструкциями на доработку, 24 ушли к человеку. Один прогон из шести прервал его собственный руководитель раньше, чем на работу посмотрел человек. Это ровно та проверка, которую инструмент с одним агентом оставляет вам, — здесь она стоит один вызов модели на ребро и посчитана.
За тот же период влито 202 pull request в 7 репозиториях — примерно 17 в неделю, в ту самую платформу, о которой вы читаете, причём каждое слияние делал человек. По всей организации работа, написанная агентами, влилась в 773 случаях из 875 открытых. Forge — не демо, работающее рядом с продуктом; это способ, которым продукт собирается, и это его коммиты.
Успешный прогон занимает примерно 39 минут и 5 передач. Медиана от запуска до завершения — и внутри этих 39 минут лежат проверки, которые не дали 80 результатам работы доехать до следующей роли в том виде, в каком они были написаны.
Обратите внимание, чего здесь нет: ни кратности продуктивности, ни сэкономленных часов. Чтобы их получить, пришлось бы придумать базу сравнения. Счёт того, что система сделала, в принципе проверяем; процент улучшения относительно неназванной альтернативы не проверяем никак — а у кастомного Droid, которого оценивает вызвавший его агент, попросту нет ребра, на котором можно было бы записать число вроде этих 56.
Попросите провести вас по самим прогонам — ветка, коммиты передач, вердикты, которые вернули работу назад, и те, что ушли к человеку. Любое другое число на этом сайте относится к конкретному прогону и так и подписано: 18 собранных источников, 11 проверенных прямым обращением, 4 подтверждённых перекрёстно и 2 помеченных как непроверяемые — на странице сценария .
Источники
- factory.ai — позиционирование, имена клиентов.
- factory.ai/product/droids — что такое Droid, регулируемая автономность, модель разрешений, выбор модели, поверхности.
- factory.ai/enterprise — интеграции, стандарты соответствия, поддержка и обсуждаемые выше цифры ROI.
- Утверждения о Forge на этой странице ведут на соответствующие страницы возможностей , где механика описана подробно.