Даже идеальная LLM не сделает агентные системы предсказуемыми — проблема в архитектуре, а не в модели
Даже если завтра появится LLM с нулевым уровнем галлюцинаций, многоагентный пайплайн всё равно может вести себя непредсказуемо. Вендоры потратили последние годы на то, чтобы сделать модели предсказуемее — RAG, fine-tuning, верификация выходов, низкая температура, жёсткие промпт-шаблоны. В узких доменах это работает, и уровень галлюцинаций становится незначимым, что позволило перейти от единичных запросов к многоагентным архитектурам.
Вместо одной универсальной модели теперь используются цепочки специализированных агентов, каждый из которых решает свою подзадачу и передаёт результат дальше. Логика подсказывает: если каждое звено надёжно, надёжна и вся цепочка. Но на простейшем демонстрационном проекте автор показывает, что это не так — источник непредсказуемости смещается с вероятностной природы самой модели на архитектуру взаимодействия агентов.