Как научить ИИ не сдаваться в переговорах: разбор метода AgonArena
Простая инструкция «сыграй начальника» не делает LLM стойким переговорщиком: модель легко поддаётся после нескольких убедительных доводов. Проблема в том, что стандартная ролевая репетиция не формирует у модели навык отстаивать позицию — она лишь имитирует роль без обратной связи.
Автор проекта AgonArena предлагает дополнить ролевую игру циклом тренировки: модель получает не только сценарий, но и механизм оценки своих аргументов, а затем корректирует поведение. Такой подход превращает одноразовую симуляцию в полноценный обучающий цикл, где ИИ учится не уступать под давлением.
В статье подробно разбирается архитектура AgonArena: как строится диалог, какие метрики используются для оценки «упёртости» модели и как это влияет на её итоговую стратегию. Проект открыт для экспериментов и может быть полезен всем, кто хочет научить LLM вести переговоры без автоматической капитуляции.