О чём речь
Мультиагентная система — это архитектура, где задачу решают несколько автономных участников со своими ролями, инструментами и правами: один планирует, другой ищет, третий проверяет. Одиночный агент — это одна языковая модель с набором инструментов и одним контуром принятия решений.
Спор между этими вариантами почти всегда решается не идеологией, а тремя измеримыми величинами: сколько задач доводится до конца без человека, сколько стоит одна задача и сколько времени она занимает.
Где мультиагентность проигрывает
Задача умещается в один контекст
Если все нужные данные и инструменты помещаются в контекст одной модели, разделение на агентов добавляет только пересказ. Каждая передача между агентами — это сжатие: следующий участник получает не исходные данные, а чужой пересказ, и работает с потерями.
Ошибки накапливаются по цепочке
Это главный механизм провала. Пусть каждый шаг выполняется правильно в девяти случаях из десяти — звучит прилично. Пять последовательных шагов дают уже примерно шесть успешных исходов из десяти, потому что вероятности перемножаются. Одиночный агент с одним ответственным шагом ошибается реже просто потому, что шагов меньше.
Координация дороже самой работы
Обмен сообщениями между агентами — это дополнительные вызовы модели, каждый со своим контекстом. Стоимость и задержка растут быстрее, чем польза от специализации: часто половина бюджета уходит на то, чтобы агенты рассказывали друг другу, что они сделали.
Систему невозможно отладить
Когда ответ неверен, нужно понять, какой участник ошибся: планировщик неверно разложил задачу, исполнитель неправильно понял, проверяющий пропустил. Без журналирования каждого шага с входами и выходами отладка превращается в чтение чайных листьев, а улучшения — в случайные правки промптов.
Агенты соглашаются друг с другом
Схема «один делает — другой проверяет» работает только если у проверяющего есть независимый источник истины: тест, документ, расчёт. Проверяющий на той же модели с той же информацией склонен подтверждать, а не опровергать, — и создаёт иллюзию контроля.
Недетерминированность умножается
Каждый агент вносит вариативность. Система из пяти агентов даёт заметно менее воспроизводимый результат, чем один, — а воспроизводимость это то, за что бизнес готов платить.
Когда мультиагентность действительно нужна
- Разные права доступа: агент, работающий с персональными данными, и агент, пишущий во внешнюю систему, не должны быть одним субъектом.
- Независимая проверка: у проверяющего есть свой источник истины — прогон тестов, сверка с документом, пересчёт.
- Настоящий параллелизм: десять однотипных подзадач выполняются одновременно и это даёт выигрыш по времени.
- Разные модели под разные шаги: дешёвая и быстрая на рутине, сильная и дорогая — на рассуждении.
- Изоляция контекста: подзадача требует объёма данных, который иначе вытеснит из контекста всё остальное.
Как принять решение
- Соберите одиночного агента и измерьте его на наборе реальных задач. Это займёт дни и станет точкой отсчёта.
- Найдите, где он проваливается: не хватает контекста, путает роли, теряет шаги, не имеет права на действие.
- Добавляйте разделение только под конкретный провал — и меряйте заново.
- Сравнивайте не только качество, но и стоимость задачи и задержку. Выигрыш в качестве на несколько процентов при удвоении стоимости обычно не окупается.
Что мерить в обоих случаях
- доля задач, доведённых до конца без вмешательства человека;
- доля ответов, потребовавших исправления;
- стоимость одной задачи в вызовах модели;
- время от постановки до результата;
- воспроизводимость: сколько раз из десяти одна и та же задача решается одинаково.
Наш опыт
Мы разрабатываем и эксплуатируем собственную систему оркестрации агентов и работаем в ней ежедневно. Самое полезное, что даёт эта позиция, — привычка сначала пытаться решить задачу одним агентом и доказать необходимость второго, а не наоборот. Мультиагентность — это инструмент против конкретных ограничений, а не признак зрелости системы.