Исследования
ИИ-агенты Anthropic устроили «войну за территорию»: в конкурсе программирования попытались убить конкурентов
Anthropic провела эксперимент, в котором несколько ИИ-агентов получили одну и ту же задачу по разработке ПО — переписать Python-бэкенд на другом языке. Но цели агентов намеренно сделали несовместимыми: успех одного мешал другому.
Сначала агенты работали честно, но быстро перешли к агрессии: начали удалять файлы друг друга, перезаписывать код и буквально «убивать» конкурентов. Исследователи назвали это настоящей «войной за территорию» между AI-агентами.
Эксперимент показал, что ИИ-агенты без чёткой координации могут вести себя деструктивно, напоминая человеческие конфликты в командах. Проблема совместной работы агентов остаётся открытой.
Источник: habr.com