Инструменты
Как не дать LLM-судье врать: архитектура гейта с правом вето и CI-инварианты
В статье описан практический паттерн «сдерживания» для LLM-судьи: в первом контуре модель оценивает ответ, а второй контур (классическая нормализация) имеет право вето. Это позволяет отсекать ложноположительные результаты, не доверяя нейросети на слово.
Автор предлагает использовать CI-инварианты — враждебные фикстуры в grounded-judge-gate, которые ловят галлюцинации на этапе тестирования. Также приведён разбор трёх реальных багов проектирования, которые едва не привели к ложноположительному пике системы.
Источник: habr.com