Фичи и апдейты
Экономия на LLM убивает агентные системы: дешёвая модель делает в три раза больше вызовов
Разработчики агентных систем попали в ловушку: провайдеры снижают цену за токен, команды переходят на облегчённые версии, экономя на вычислениях. Но на реальных задачах дешёвая модель делает в три раза больше вызовов инструментов, теряет способность планировать, начинает галлюцинировать и исправлять ошибки новыми ошибками.
Счёт за токены незаметно растёт, время выполнения задачи увеличивается, а результат страдает. Это не просто жадность — это системная проблема рынка ИИ, где экономия на модели может обернуться самой дорогой скрытой инвестицией в проекте.
Источник: habr.com