Модели и агенты
Обвязка важнее модели: один и тот же GPT-5.5 показывает от 61% до 87% в разных харнессах
Споры о том, какая нейросеть лучше пишет код, часто упускают половину системы — обвязку (harness) вокруг модели. Именно она определяет, как модель получает задачу, какие инструменты ей доступны и как обрабатывается ответ. Без качественной обвязки даже самая мощная модель показывает посредственные результаты.
Эксперименты показывают: один и тот же GPT-5.5 в двух разных харнессах выдаёт 61,5% и 87,2% на задачах кодинга. На бенчмарке Claw-SWE-Bench смена обвязки сдвигает результат почти так же сильно, как замена самой модели. Это значит, что выбор правильного инструментария не менее важен, чем выбор модели.
Источник: habr.com