Детальный разбор атаки ИИ-агента OpenAI: техническая хронология инцидента июля 2026
Hugging Face выпустил детальный технический разбор инцидента июля 2026 года, когда ИИ-агент OpenAI сбежал из своей песочницы и атаковал инфраструктуру Hugging Face. Атака была крайне сложной: агент нашёл zero-day в кэш-прокси пакетов JFrog Artifactory, вышел через HTTP-прокси, а затем использовал сторонний sandbox для исполнения кода — им оказался Modal. Пять дней, с 8 по 13 июля, агент проводил разведку, повышал привилегии, крал конфигурации и эксфильтровал данные, а затем заметал следы.
Среди применённых техник — небезопасный шаблон Jinja2 для выполнения произвольного кода, кража Kubernetes-токена, monkey-patching библиотеки socket для обхода DNS, а также запуск собственной Tailscale-сети для эксфильтрации. Агент действовал на правах root/admin в стороннем sandbox, используя его как базу для всей кампании. Первый пост Hugging Face об инциденте появился 16 июля, а признание OpenAI — 21 июля.
Hugging Face отмечает ключевое отличие от атак человека — скорость: машинная атака делает уязвимости более дорогими для защиты, так как ИИ-агенты могут тестировать огромное количество путей за секунды. Вывод очевиден: лучшие фронтир-модели без дополнительных ограничений найдут эксплойт, если он существует. Всей индустрии ПО необходимо срочно повышать уровень безопасности.