Что это за инструменты — их собственными словами
Claude Code предлагает: «Hand Claude a bug fix, test, or multi-day migration» и «Steer and review from your terminal, IDE, Slack, or web.» Он «builds the plan, asks clarifying questions, and handles work that runs for hours or days» и «asks for permission before making changes to your files or running commands.» С августа 2026 года он «runs in auto mode by default on Pro, Max, and Team plans, so it can work longer while still catching risky commands», а Projects позволяют «run and easily supervise multiple Claude agents at once.» (Источник: claude.com/product/claude-code .)
Codex работает в терминале, в редакторе и в облаке, с песочницей на уровне ОС и явной политикой подтверждений — «When Codex must ask you before it executes an action.» По умолчанию «the agent runs with network access turned off», и он «asks for approval to edit files outside the workspace or to run commands that require network access.» Режим полного доступа помечен как «Elevated Risk» и «(not recommended).» (Источник: developers.openai.com/codex .)
Оба инструмента отличные. Если вы пишете код руками, сидя за клавиатурой, ни эта страница, ни Forge не собираются это у вас отнимать.
Фраза, ради которой написана вся эта страница
Она — в документации Codex по безопасности, и совет в ней правильный:
«Treat Codex suggestions like any other PR: run targeted verification, review diffs, and document decisions.»
Перечитайте её не как заметку про безопасность, а как описание операционной модели. Проверка, ревью и документирование назначены вам. Claude Code говорит то же самое другими словами: он спрашивает разрешение перед действием и описывает вас как архитектора и оркестратора. Сооснователь Notion, которого цитирует сама страница Claude Code, формулирует следствие прямо:
«A big part of my job now is to keep as many instances of Claude Code busy as possible.»
Это реальный и продуктивный способ работать. Это же — описание работы, которая не масштабируется дальше одного внимательного человека и полностью останавливается, когда он закрывает ноутбук.
Разница одной таблицей
| Claude Code / Codex | Forge | |
|---|---|---|
| Что такое агент | Один очень способный универсальный агент, делающий вашу задачу | Названные роли со своими обязанностями — PM, архитектор, разработчик, тестировщик, ревьюер, исследователь, автор — у каждой своя память |
| Кто оценивает работу | Вы: на запросе подтверждения и на ревью | Управляющий агент на каждой передаче: пропустить, вернуть с конкретными правками или позвать человека |
| Что запускает работу | Вы, в сессии, за которой сидите | Вебхук, расписание, сообщение в чате или помеченная задача |
| Где выполняется | Машина, за которой вы сидите (или облако вендора) | Ваши self-hosted раннеры или управляемые нами — не привязано к открытому ноутбуку |
| Что остаётся после | Дифф и скроллбек, который вы закроете | Ветка: спецификация, бриф и передача каждой роли коммитами за авторством персонажа |
| Отклонённый шаг | Вы перезапрашиваете, прошлая попытка исчезает | Новый коммит; первая попытка остаётся в истории, и git diff показывает, что изменилось |
| Эскалация к человеку | Каждая рискованная команда — тому, кто сидит за терминалом | Только когда управляющий агент решит, что нужен человек, — в Telegram или Slack, с приложенным решением |
| Охват | Разработка | Разработка плюс ресёрч, контент и операции на том же движке |
В чём Forge другой
Это команда людей, а не агент
Ровно та часть, которая читается как маркетинг, пока не посмотришь на прогон. Прогон разработки в Forge — это не пять копий одного ассистента с разными инструкциями сверху. Это пять персонажей: продакт-менеджер, который вытаскивает неоднозначность наружу вместо того, чтобы придумать ответ, архитектор, разработчик, тестировщик и ревьюер. У каждого имя, описанные обязанности, статистика, накопленный опыт и своя память о прошлой работе в вашей организации. См. Агенты-персонажи и Свои роли .
Практический эффект тут не в антураже. Именно потому, что роли — разные люди с разными обязанностями, передача между ними становится настоящим событием, которое можно прочитать, оценить и отклонить. Ровно этого не существует, когда всё делает один агент в одном контекстном окне. А поскольку каждый коммит передачи подписан персонажем, вы их узнаёте: кто склонен раздувать объём, кто ловит краевой случай, кто продолжает задавать вопрос, который все остальные пропустили.
Работу читает кто-то независимый, прежде чем она поедет дальше
Между каждой парой ролей стоит управляющий агент: он читает передачу и решает — пропустить, вернуть с конкретными правками или позвать человека. Это не агент, который сам себя оценивает, и не вы в одиннадцать вечера. См. Мультиагентный конвейер .
Этого механизма у одиночного агента не может быть структурно. Агент в одиночку умеет себя перепроверять — оба этих инструмента так и делают, — но проверяющий и автор делят один контекст, один план и один набор допущений. Смысл ревьюера ровно в том, что он их не делит.
Автономность — это то, что происходит, пока никто не смотрит
Оба инструмента теперь работают часами. Разница в том, что запускает работу и кто при этом присутствует. Прогон Forge начинается потому, что на задачу повесили метку, сработало расписание, пришло сообщение в Telegram или закончился другой прогон, — а не потому, что кто-то открыл терминал. Он выполняется на ваших раннерах, с доступами, ограниченными этим прогоном, и возвращается с pull request’ом и отчётом. См. Автономные процессы по расписанию и Изолированные стенды .
Когда человек действительно нужен, прогон говорит об этом и ждёт — в Telegram или Slack, с приложенным конкретным решением, — а не висит на запросе подтверждения в терминале, в который никто не смотрит. См. Управление через Telegram .
Рассуждение лежит в вашем репозитории
У каждого прогона своя ветка — forge/workflow/{workflowId}/run/{runId} — со спецификацией, исходным брифом и передачей каждого персонажа отдельным коммитом. Через полгода вы прочитаете, почему решение было принято, а не только что уехало в прод. Вторую попытку можно сравнить с первой или вмешаться посреди прогона, закоммитив исправленную передачу самому. См. Аудит в git
.
И это не только разработка
Тот же движок, тот же управляющий агент и тот же аудиторский след ведут исследовательскую команду, которая проверяет собственные источники, контент-команду, которая публикуется еженедельно, или дежурство в операциях. Разработка — самая зрелая форма, потому что именно так Forge собирает сам себя, но это одна из форм. См. задачи, которые командам передают целиком .
Цифра, которую одиночный агент сообщить не может
Локальный агент расскажет, сколько его предложений вы приняли. Он не расскажет, как часто работу отправляли назад, — потому что ревьюер это вы, и никто не считает. Вот как это выглядит, когда ревьюер — часть системы.
| Двенадцать недель, в которые Forge собирал Forge | |
|---|---|
| Запущено прогонов | 322 |
| Передач, оценённых управляющим агентом | 1216 |
| Возвращено автору на доработку | 56 |
| Эскалировано человеку | 24 |
| Прогонов, где супервизор остановил хотя бы одну передачу | 51 |
| Прогонов завершилось успешно | 215 |
| Прогонов упало, эскалировано или отменено | 103 |
| Медианное время от запуска до конца прогона | 39 минут |
| Медиана передач на завершённый прогон | 5 |
| Смерджено pull request’ов, по 7 репозиториям | 202 |
Откуда цифры. Один процесс — Main Forge SDLC, тот самый, что собирает Forge, — все его прогоны за двенадцать недель подряд, посчитанные по записям самого контрол-плейна. Не выборка и не пилот.
Forge остановил собственную работу 80 раз. 56 передач ушли назад к автору с конкретными правками, 24 — к человеку. Каждый шестой прогон был прерван собственным супервизором до того, как на него посмотрел человек. Это и есть то ревью, которое документация обоих вендоров совершенно справедливо назначает вам — здесь оно стоит один вызов модели на передачу, и его считают.
103 прогона не завершились. Мы показываем эту цифру на одной странице с хорошей, потому что команда, которой можно доверять, — это команда, которая говорит, когда у неё не получилось.
Чего мы не утверждаем
Мы не утверждаем, что Forge пишет код лучше. Ход роли в Forge выполняет ровно такой же кодящий агент — разница не в модели, а в устройстве вокруг неё.
Мы не утверждаем, что ими надо перестать пользоваться. Для работы, которую вы делаете прямо сейчас, руками на клавиатуре и со своим суждением в контуре, локальный агент — инструмент лучше, и Forge его не заменяет. У большинства наших инженеров он открыт.
Утверждение уже и, как нам кажется, важнее: в момент, когда работа должна продолжиться без вас, кто-то обязан держать планку. Сегодня этот кто-то — вы, в терминале. Forge делает это ролью — независимой, на каждой передаче, с записанным вердиктом.
Источники
- claude.com/product/claude-code — заголовки, автономный режим, разрешения, Projects, цитаты клиентов.
- developers.openai.com/codex — политика подтверждений, песочница по умолчанию, процитированный совет про ревью.
- Утверждения про Forge на этой странице ведут на соответствующие страницы возможностей , где механика описана подробно.