и LangGraph

Forge и LangGraph

LangGraph — низкоуровневый фреймворк, в котором вы сами пишете граф агентского рантайма. Forge — уже работающая система поверх той же идеи: вы описываете команду обычным языком, а управляющий агент оценивает каждую передачу, прежде чем её увидит следующая роль. Одно — библиотека, другое — продукт.

Фреймворк просит вас написать граф

LangGraph даёт ноды, рёбра, состояние и чекпойнты и полный контроль над их содержимым — намеренно. Forge принимает бриф на обычном языке и предлагает роли, переходы и валидатора вам на одобрение. Если вы хотите владеть когнитивной архитектурой — это аргумент за LangGraph, а не против него.

Проверка — это ребро графа, а не код, который надо не забыть написать

В LangGraph есть human-in-the-loop прерывания, которые вы ставите там, где решили. В Forge управляющий агент по умолчанию читает каждую передачу и либо пропускает её, либо возвращает с инструкциями на доработку, либо эскалирует человеку. Это сам цикл, а не фича, которую надо подключить.

Состояние живёт в вашем git, а не в чекпойнтере

LangGraph сохраняет состояние, чтобы прогон можно было продолжить. Артефакт Forge — ветка в репозитории, который принадлежит вам: спецификация, бриф и передача каждой роли отдельными коммитами. Она переживёт и прогон, и дашборд, и нас.

Эксплуатационная часть тоже входит

Расписания, подтверждения через Telegram, скоупинг секретов, маршрутизация провайдеров с failover, self-hosted раннеры, агенты на организацию. С фреймворком каждый из этих пунктов — отдельный проект.

Что такое LangGraph — его собственными словами

LangChain описывает LangGraph как «an agent runtime and low-level orchestration framework» для агентов, которые «reliably handle complex tasks», под заголовком «Balance agent control with agency» и слоганом «Build agents with low-level control». Он поддерживает «single, multi-agent, hierarchical» потоки управления «all using one framework», позволяет «Guide, moderate, and control your agent with human-in-the-loop» и «Add human-in-the-loop checks to steer and approve agent actions», хранит память «for future interactions», даёт «first-class streaming» и заявляет, что «will not add any overhead to your code». Сам LangGraph — «an MIT-licensed open-source library and is free to use». Коммерческий слой — LangSmith, «our agent engineering platform», продающийся в вариантах Cloud, BYOC («LangChain runs the control plane, you run your data planes») и Self-hosted, причём последние два «available on the Enterprise plan». (Источники: langchain.com/langgraph и docs.langchain.com .)

Мы цитируем так подробно, потому что соблазнительная версия этой страницы — «LangGraph это просто библиотека графов, там нет ни человека в контуре, ни памяти, ни мультиагентности» — неверна по всем трём пунктам. Всё это есть, он работает в проде у больших компаний, а его низкоуровневая позиция — осознанный проектный выбор.

Значит, сравнение — не по списку фич. Оно про то, кто пишет архитектуру и что остаётся у вас потом.

Разница одной таблицей

LangGraphForge
Что этоБиблиотека, на которой вы пишете свой агентский рантаймРаботающая система, которая ведёт агентские команды за вас
Что вы создаётеНоды, рёбра, схему состояния, чекпойнтер — на Python или JSБриф на обычном языке; Forge предлагает роли, переходы и валидатора вам на одобрение
Кто проверяет шагВы — расставляя прерывания и написав саму проверкуУправляющий агент на каждой передаче по умолчанию: пропустить, вернуть с инструкциями на доработку или эскалировать человеку
Отклонённый шагТо, что вы заложили в графНовый коммит; предыдущая попытка остаётся в истории, git diff показывает, что изменилось
Где остаётся следЧекпойнтер (Postgres, Redis, память) плюс трассировки в LangSmithВетка в вашем репозитории — спецификация, бриф и каждая передача коммитами, роль указана как Co-authored-by
Расписания, подтверждения, секреты, уведомленияВы их пишете сами или покупаете платформенный тарифВходят: cron-расписания, подтверждения в Telegram, скоупинг секретов, уведомления, агенты на организацию
Выбор модели«any model provider» — ваш код сам её вызываетШлюз маршрутизации по пулу провайдеров с весами приоритета и автоматическим failover
Где выполняетсяТам, где вы развернёте; managed/BYOC/self-hosted через LangSmith EnterpriseУправляемый SaaS или self-hosted раннеры на вашем железе
ОбластьВсё, что выражается графомРазработка (самый зрелый архетип), а также ресёрч, контент и операции

В чём Forge устроен иначе

Вы описываете команду, а не граф. На входе одна фраза: «исследователь, который собирает источники, аналитик, который заново открывает каждый и проверяет цитату, и автор, который превращает это в текст для клиента». Forge предлагает роли, переходы и управляющего агента и ждёт одобрения, прежде чем что-то потратить. Подробнее: Workflow Engine .

Валидатор встроен в конструкцию. Во фреймворке шаг проверки — нода, которую вы решили добавить, и код, который вы решили написать; честный сценарий отказа в том, что под дедлайн его не пишут. В Forge управляющий агент стоит на каждом ребре по умолчанию: читает передачу и пропускает её, возвращает с конкретными инструкциями на доработку или эскалирует человеку. Подробнее: Multi-Agent Pipeline .

Аудит — это git, и он ваш. Каждый прогон получает ветку forge/workflow/{workflowId}/run/{runId} со спецификацией, исходным брифом и структурированной и свободной передачей каждой роли в виде коммитов, где роль записана автором. Чекпойнтер позволяет продолжить прогон; ветка позволяет человеку через два квартала прочитать аргументацию, сравнить вторую попытку с первой или вмешаться, закоммитив исправленную передачу. Исчезни мы завтра — история остаётся git-репозиторием у вас на диске. Подробнее: Git-Backed Audit .

Эксплуатационная часть уже есть. Cron-расписания, подтверждения и запуск через Telegram , скоупинг секретов и контроль egress , уведомления , self-hosted раннеры и шлюз маршрутизации с весами приоритета и автоматическим failover по Anthropic, Google, Z.AI, Ollama, self-hosted моделям и любому OpenAI-совместимому эндпоинту. С фреймворком каждый пункт — проект.

И это не только про софт. Тот же движок, тот же цикл проверки и тот же аудит ведут команду ресёрча, которая проверяет собственные источники, контент-команду или дежурство в операциях. Смотрите сценарии .

Число, которое один агент показать не может

Фреймворк можно заставить выдать такую таблицу. Наша система выдала её без того, чтобы кто-то решил её построить, — и это весь аргумент за систему с мнением, выраженный числом, а не философией.

Двенадцать недель, за которые Forge собирал Forge
Запущено прогонов322
Передач оценено управляющим агентом1216
Возвращено автору на доработку56
Эскалировано человеку24
Прогонов, где руководитель остановил хотя бы одну передачу51
Прогонов завершилось успешно215
Прогонов упало, эскалировано или отменено103
Медианное время от запуска до конца прогона39 минут
Медианное число передач на успешный прогон5
Влитых pull request в 7 репозиториях202

Откуда это взято. Один процесс — Main Forge SDLC, тот самый, который собирает Forge, — все его прогоны за двенадцать недель подряд, посчитанные по собственным записям управляющего контура. Не выборка, не пилот и не клиентский кейс, который мы не можем показать.

Forge останавливал собственную работу 80 раз. 56 передач вернулись автору с конкретными инструкциями на доработку, 24 ушли к человеку. Один прогон из шести прервал его собственный руководитель раньше, чем на работу посмотрел человек. Это ровно та проверка, которую инструмент с одним агентом оставляет вам, — здесь она стоит один вызов модели на ребро и посчитана.

За тот же период влито 202 pull request в 7 репозиториях — примерно 17 в неделю, в ту самую платформу, о которой вы читаете, причём каждое слияние делал человек. По всей организации работа, написанная агентами, влилась в 773 случаях из 875 открытых. Forge — не демо, работающее рядом с продуктом; это способ, которым продукт собирается, и это его коммиты.

Успешный прогон занимает примерно 39 минут и 5 передач. Медиана от запуска до завершения — и внутри этих 39 минут лежат проверки, которые не дали 80 результатам работы доехать до следующей роли в том виде, в каком они были написаны.

Этот шаг проверки отработал 1216 раз, и никому не пришлось про него вспоминать. На LangGraph эта таблица — нода, которую вы пишете, хранилище, которое вы эксплуатируете, и схема, которую вы версионируете; собранную версию вы же и сопровождаете, ровно столько, сколько её запускаете.

Попросите провести вас по самим прогонам — ветка, коммиты передач, вердикты, которые вернули работу назад, и те, что ушли к человеку. Любое другое число на этом сайте относится к конкретному прогону и так и подписано: 18 собранных источников, 11 проверенных прямым обращением, 4 подтверждённых перекрёстно и 2 помеченных как непроверяемые — на странице сценария .

Источники

Это можно собрать на LangGraph. Вопрос — хотите ли вы этим заниматься.

Принесите процесс, ради которого пришлось бы квартал строить рантайм. Forge предложит команду и дождётся вашего одобрения, прежде чем что-то потратить.