и локальные агенты

Forge и Claude Code / Codex

Локальный кодящий агент — лучшее, что случалось с клавиатурой разработчика. И документация обоих вендоров говорит про него одно и то же: ревьюер — вы. Forge ставит вокруг такого агента команду из названных ролей, менеджера, который оценивает каждую передачу, и запись о том, почему решение принято, — чтобы работа шла, когда рядом никого нет.

Их собственная документация уже говорит, кто здесь ревьюер

На странице безопасности Codex написано: относитесь к его результату «like any other PR: run targeted verification, review diffs, and document decisions». Claude Code спрашивает разрешение перед действием и сажает вас в кресло оркестратора. Это честный и правильный совет — и он же означает, что последняя линия обороны — человек, который обязан быть на месте. В Forge этот ревьюер — роль внутри системы, и его вердикты считаются.

Команда из названных людей, а не один способный агент

Forge не запускает пять копий универсального ассистента. Он запускает продакт-менеджера, архитектора, разработчика, тестировщика и ревьюера — у каждого имя, описание обязанностей, своя память и своя модель. Передача — это коммит за авторством персонажа, так что со временем вы знаете их в лицо: кто склонен раздувать объём, а кто ловит краевой случай.

Автономность — это то, что происходит, пока вы спите

Оба инструмента умеют работать часами — и оба привязаны к сессии, которую вы открыли и за которой следите. Прогон Forge стартует от вебхука, расписания или сообщения в чате, выполняется на ваших раннерах, зовёт человека только когда управляющий агент решит, что человек нужен, и отчитывается в Telegram или Slack по готовности.

Зафиксирован не только ответ, но и рассуждение

От сессии в терминале остаётся дифф и скроллбек, который вы закроете. От прогона Forge остаётся ветка со спецификацией, исходным брифом и передачей каждой роли отдельными коммитами. Вторую попытку можно сравнить с первой, прочитать вердикт, отправивший работу назад, или самому поправить передачу прямо посреди прогона.

Мы не обходим эти агенты стороной — мы на них работаем

Ход роли в Forge выполняет ровно такой же кодящий агент, на вашем железе, через пул провайдеров, которым управляете вы. Эта страница не доказывает, что локальные агенты плохи. Она про слой над ними, который сегодня — вы.

Что это за инструменты — их собственными словами

Claude Code предлагает: «Hand Claude a bug fix, test, or multi-day migration» и «Steer and review from your terminal, IDE, Slack, or web.» Он «builds the plan, asks clarifying questions, and handles work that runs for hours or days» и «asks for permission before making changes to your files or running commands.» С августа 2026 года он «runs in auto mode by default on Pro, Max, and Team plans, so it can work longer while still catching risky commands», а Projects позволяют «run and easily supervise multiple Claude agents at once.» (Источник: claude.com/product/claude-code .)

Codex работает в терминале, в редакторе и в облаке, с песочницей на уровне ОС и явной политикой подтверждений — «When Codex must ask you before it executes an action.» По умолчанию «the agent runs with network access turned off», и он «asks for approval to edit files outside the workspace or to run commands that require network access.» Режим полного доступа помечен как «Elevated Risk» и «(not recommended).» (Источник: developers.openai.com/codex .)

Оба инструмента отличные. Если вы пишете код руками, сидя за клавиатурой, ни эта страница, ни Forge не собираются это у вас отнимать.

Фраза, ради которой написана вся эта страница

Она — в документации Codex по безопасности, и совет в ней правильный:

«Treat Codex suggestions like any other PR: run targeted verification, review diffs, and document decisions.»

Перечитайте её не как заметку про безопасность, а как описание операционной модели. Проверка, ревью и документирование назначены вам. Claude Code говорит то же самое другими словами: он спрашивает разрешение перед действием и описывает вас как архитектора и оркестратора. Сооснователь Notion, которого цитирует сама страница Claude Code, формулирует следствие прямо:

«A big part of my job now is to keep as many instances of Claude Code busy as possible.»

Это реальный и продуктивный способ работать. Это же — описание работы, которая не масштабируется дальше одного внимательного человека и полностью останавливается, когда он закрывает ноутбук.

Разница одной таблицей

Claude Code / CodexForge
Что такое агентОдин очень способный универсальный агент, делающий вашу задачуНазванные роли со своими обязанностями — PM, архитектор, разработчик, тестировщик, ревьюер, исследователь, автор — у каждой своя память
Кто оценивает работуВы: на запросе подтверждения и на ревьюУправляющий агент на каждой передаче: пропустить, вернуть с конкретными правками или позвать человека
Что запускает работуВы, в сессии, за которой сидитеВебхук, расписание, сообщение в чате или помеченная задача
Где выполняетсяМашина, за которой вы сидите (или облако вендора)Ваши self-hosted раннеры или управляемые нами — не привязано к открытому ноутбуку
Что остаётся послеДифф и скроллбек, который вы закроетеВетка: спецификация, бриф и передача каждой роли коммитами за авторством персонажа
Отклонённый шагВы перезапрашиваете, прошлая попытка исчезаетНовый коммит; первая попытка остаётся в истории, и git diff показывает, что изменилось
Эскалация к человекуКаждая рискованная команда — тому, кто сидит за терминаломТолько когда управляющий агент решит, что нужен человек, — в Telegram или Slack, с приложенным решением
ОхватРазработкаРазработка плюс ресёрч, контент и операции на том же движке

В чём Forge другой

Это команда людей, а не агент

Ровно та часть, которая читается как маркетинг, пока не посмотришь на прогон. Прогон разработки в Forge — это не пять копий одного ассистента с разными инструкциями сверху. Это пять персонажей: продакт-менеджер, который вытаскивает неоднозначность наружу вместо того, чтобы придумать ответ, архитектор, разработчик, тестировщик и ревьюер. У каждого имя, описанные обязанности, статистика, накопленный опыт и своя память о прошлой работе в вашей организации. См. Агенты-персонажи и Свои роли .

Практический эффект тут не в антураже. Именно потому, что роли — разные люди с разными обязанностями, передача между ними становится настоящим событием, которое можно прочитать, оценить и отклонить. Ровно этого не существует, когда всё делает один агент в одном контекстном окне. А поскольку каждый коммит передачи подписан персонажем, вы их узнаёте: кто склонен раздувать объём, кто ловит краевой случай, кто продолжает задавать вопрос, который все остальные пропустили.

Работу читает кто-то независимый, прежде чем она поедет дальше

Между каждой парой ролей стоит управляющий агент: он читает передачу и решает — пропустить, вернуть с конкретными правками или позвать человека. Это не агент, который сам себя оценивает, и не вы в одиннадцать вечера. См. Мультиагентный конвейер .

Этого механизма у одиночного агента не может быть структурно. Агент в одиночку умеет себя перепроверять — оба этих инструмента так и делают, — но проверяющий и автор делят один контекст, один план и один набор допущений. Смысл ревьюера ровно в том, что он их не делит.

Автономность — это то, что происходит, пока никто не смотрит

Оба инструмента теперь работают часами. Разница в том, что запускает работу и кто при этом присутствует. Прогон Forge начинается потому, что на задачу повесили метку, сработало расписание, пришло сообщение в Telegram или закончился другой прогон, — а не потому, что кто-то открыл терминал. Он выполняется на ваших раннерах, с доступами, ограниченными этим прогоном, и возвращается с pull request’ом и отчётом. См. Автономные процессы по расписанию и Изолированные стенды .

Когда человек действительно нужен, прогон говорит об этом и ждёт — в Telegram или Slack, с приложенным конкретным решением, — а не висит на запросе подтверждения в терминале, в который никто не смотрит. См. Управление через Telegram .

Рассуждение лежит в вашем репозитории

У каждого прогона своя ветка — forge/workflow/{workflowId}/run/{runId} — со спецификацией, исходным брифом и передачей каждого персонажа отдельным коммитом. Через полгода вы прочитаете, почему решение было принято, а не только что уехало в прод. Вторую попытку можно сравнить с первой или вмешаться посреди прогона, закоммитив исправленную передачу самому. См. Аудит в git .

И это не только разработка

Тот же движок, тот же управляющий агент и тот же аудиторский след ведут исследовательскую команду, которая проверяет собственные источники, контент-команду, которая публикуется еженедельно, или дежурство в операциях. Разработка — самая зрелая форма, потому что именно так Forge собирает сам себя, но это одна из форм. См. задачи, которые командам передают целиком .

Цифра, которую одиночный агент сообщить не может

Локальный агент расскажет, сколько его предложений вы приняли. Он не расскажет, как часто работу отправляли назад, — потому что ревьюер это вы, и никто не считает. Вот как это выглядит, когда ревьюер — часть системы.

Двенадцать недель, в которые Forge собирал Forge
Запущено прогонов322
Передач, оценённых управляющим агентом1216
Возвращено автору на доработку56
Эскалировано человеку24
Прогонов, где супервизор остановил хотя бы одну передачу51
Прогонов завершилось успешно215
Прогонов упало, эскалировано или отменено103
Медианное время от запуска до конца прогона39 минут
Медиана передач на завершённый прогон5
Смерджено pull request’ов, по 7 репозиториям202

Откуда цифры. Один процесс — Main Forge SDLC, тот самый, что собирает Forge, — все его прогоны за двенадцать недель подряд, посчитанные по записям самого контрол-плейна. Не выборка и не пилот.

Forge остановил собственную работу 80 раз. 56 передач ушли назад к автору с конкретными правками, 24 — к человеку. Каждый шестой прогон был прерван собственным супервизором до того, как на него посмотрел человек. Это и есть то ревью, которое документация обоих вендоров совершенно справедливо назначает вам — здесь оно стоит один вызов модели на передачу, и его считают.

103 прогона не завершились. Мы показываем эту цифру на одной странице с хорошей, потому что команда, которой можно доверять, — это команда, которая говорит, когда у неё не получилось.

Чего мы не утверждаем

Мы не утверждаем, что Forge пишет код лучше. Ход роли в Forge выполняет ровно такой же кодящий агент — разница не в модели, а в устройстве вокруг неё.

Мы не утверждаем, что ими надо перестать пользоваться. Для работы, которую вы делаете прямо сейчас, руками на клавиатуре и со своим суждением в контуре, локальный агент — инструмент лучше, и Forge его не заменяет. У большинства наших инженеров он открыт.

Утверждение уже и, как нам кажется, важнее: в момент, когда работа должна продолжиться без вас, кто-то обязан держать планку. Сегодня этот кто-то — вы, в терминале. Forge делает это ролью — независимой, на каждой передаче, с записанным вердиктом.

Источники

  • claude.com/product/claude-code — заголовки, автономный режим, разрешения, Projects, цитаты клиентов.
  • developers.openai.com/codex — политика подтверждений, песочница по умолчанию, процитированный совет про ревью.
  • Утверждения про Forge на этой странице ведут на соответствующие страницы возможностей , где механика описана подробно.

Локальный агент у вас уже работает. Кто ревьюит его, когда вас нет?

Наведите Forge на один репозиторий и один хорошо описанный тикет и прочитайте коммиты передач. Именно эту часть терминал показать не может.