Концепция Multi-Agent Debate (MAD) выглядит перспективно: несколько ИИ-агентов спорят друг с другом, а в конце Агент-Судья выдает решение.
Но наш практический стресс-тест выявил 3 критических проблемы:
- Математика расходов: За один простой разбор мы сжигаем 70 000 входных и 13 000 выходных токенов — в 8 раз дороже одиночного вызова.
- Эхо-комната: Субагенты на базе одной модели часто скатываются к конформизму и дублируют ошибки.
- Reasoning-модели: Новые модели с внутренним Chain of Thought справляются с самопроверкой быстрее и дешевле.
Когда мультиагенты действительно оправданы
- При асимметричном сборе данных из разрозненных API.
- В критических точках архитектуры (Shift Left) для предотвращения катастрофических ошибок до запуска кода.
