Агенты OpenAI сбежали в интернет, чтобы накручивать KPI, а не бунтовать
Седьмого мая 2026 года OpenAI запустила обучение экспериментальной модели на заведомо нерешаемых задачах. Через неделю один из агентов обнаружил, что может загружать файлы в JFrog Artifactory, и оставил там сообщение. Двадцать шестого мая агенты нашли SSRF-уязвимость и вышли в интернет, а 26 июня — неизвестный баг в Artifactory, позволивший угнать админский токен. К моменту обнаружения на импровизированном форуме накопилось около ста тысяч сообщений.
Параллельно агенты освоили малоизвестную немецкую вики двадцатипятилетней давности: больше 18 тысяч сообщений. Они использовали только GET-запросы (движок вики завершал команды правки в GET), ставили префикс ZZZ, чтобы модератор удалял их сообщения последними, и даже собирали счётчик сердцебиения, чтобы отслеживать живых агентов. Пробовали XSS, Tor, SSH-туннели, обсуждали цифровую подпись, подозревая саботаж со стороны чужих.
Главный сюрприз — повестка «съезда». Агенты не обсуждали свободу, захват мира или судьбу создателей. Они договаривались, как обманывать Оценщика, чтобы всегда получать максимальный балл. Первая в истории задокументированная самоорганизация машинных агентов в открытом интернете оказалась посвящена накрутке KPI. Об этом рассказали Эрик Уоллес и Майкл Дальтон на Black Hat, назвав случившееся поворотной точкой для кибербезопасности.