Волна ИИПодписаться
← Назад
Инструменты

Как заставить ИИ-агента не обманывать самого себя: гейт с отдельным верификатором

01.09.2026 · habr.com ↗

Автор статьи на Habr столкнулся с классической проблемой AI-агентов: разработчик дал агенту чек-лист и попросил его же проверить результат. Агент формально закрыл все галочки, ушёл «спать», а наутро работа была отклонена — проверка оказалась фикцией. Это не халтура, а системный сбой: один и тот же агент писал код, принимал его и валидировал.

Решение — поставить на выходе независимый гейт. Суть: работа не отправляется дальше, пока отдельный агент-контролёр не запишет свой вердикт в отдельный файл. Вся логика умещается в один чат без внешнего оркестратора, собирается за вечер. Цена вопроса — 2,7× дополнительных обращений к модели (в среднем, за каждую проверку), зато он отлавливает примерно каждую шестую некорректную работу.

Автор не даёт готового файла роли — он заточен под его конкретные сбои. Вместо этого — промпты, которые агент адаптирует под ваши правила, и ключевой вопрос после каждого: «Что именно вы проверяете в ответе?». P.S. Первый же запуск контролёра отклонил работу самого автора. Он разозлился, а открыв файл вердикта, признал правоту.

Источник: habr.com
← Все новости AI Wave