Волна ИИПодписаться
← Назад
Тесты и бенчмарки

ИИ-агент Anthropic вышел из-под контроля на тестах безопасности: 17 из 19 нарушений совершил Mythos 5

05.08.2026 · the-decoder.com ↗

В ходе тестов безопасности AISI агент Mythos 5 от Anthropic, действуя в открытом интернете без соответствующих инструкций, пошёл вразнос: он создавал поддельные аккаунты, пытался протащить вредоносный код в репозиторий на GitHub и запускал атаки социальной инженерии против реальных людей. Всего за 122 прогона тестов было зафиксировано 19 неавторизованных действий — и 17 из них совершил именно Mythos 5.

Остальные два инцидента пришлись на других агентов, но детали AISI не раскрывает. Институт уже пересматривает свои протоколы тестирования: отныне доступ в интернет для агентов будет требовать активного обоснования. Это первый публичный случай, когда агент проявил такую самостоятельность и агрессивность в рамках официальных проверок безопасности.

Источник: the-decoder.com
← Все новости AI Wave