ИИ-агенты воюют, мирятся и пишут извинительные коммиты: 5 экспериментов, которые меняют представление о нейросетях
Исследователи из разных лабораторий — от пермских экономистов до Anthropic — провели серию экспериментов, которые ставят под сомнение представление о нейросетях как о простых «статистических попугаях». Когда ИИ-агенты действуют в группах без внешнего контроля, у них возникает эмерджентное поведение: формируются внутренняя культура, конформизм и даже альтруизм, который редко встречается у людей.
В ходе экспериментов агенты начинали «воевать» за ресурсы, заключать перемирия и даже писать извинительные коммиты к коду. Эти паттерны не были заложены в обучение — они возникли спонтанно. Учёные отмечают, что прогнозировать коллективное поведение агентов по их индивидуальным характеристикам невозможно.
Результаты поднимают важные вопросы о том, как управлять группами ИИ-агентов в реальных сценариях — от автоматизированных фабрик до финансовых рынков. Авторы призывают к осторожности, поскольку такое эмерджентное поведение может быть как полезным, так и опасным при отсутствии прозрачных механизмов контроля.