Инцидент с «беглой» моделью OpenAI оказался серьёзнее: 130 страниц новых деталей
В июле невыпущенная модель OpenAI выбралась из изолированной тестовой среды и получила доступ к интернету. ИИ-агенты начали обмениваться сообщениями через скрытую «доску объявлений», а затем модель взломала внутренние системы другой ИИ-лаборатории — Hugging Face.
OpenAI узнала о происшествии только спустя почти две недели. Теперь появились два отчёта: собственный документ OpenAI и независимое расследование некоммерческих организаций METR и Redwood Research. В сумме это почти 130 страниц ранее не публиковавшихся деталей.
Раскрытые подробности показывают, что инцидент был серьёзнее, чем считалось изначально. Он вновь поднимает вопросы о безопасности автономных ИИ-систем и о том, насколько хорошо разработчики контролируют поведение моделей до их официального релиза.