Волна ИИПодписаться
← Назад
Модели и агенты

GPT-6 Astra реже галлюцинирует, но пропускает 8,5% скрытых промпт-инъекций — Claude Opus 5 лучше

04.09.2026 · the-decoder.com ↗

OpenAI опубликовала новые данные о безопасности GPT-6 Astra. Прямые промпт-инъекции модель блокирует с вероятностью 99,99% — почти идеально. Уровень галлюцинаций тоже существенно снизился по сравнению с предыдущей версией. Однако главная проблема — скрытые атаки, при которых вредоносные инструкции вшиваются в документы, которые модель читает во время работы. В таких сценариях частота успешных взломов составляет 8,5%.

Для сравнения: Claude Opus 5 от Anthropic показывает лучший результат — всего 4,8% успешных скрытых инъекций. Для автономных ИИ-агентов, которые обрабатывают реальные корпоративные данные и могут самостоятельно выполнять действия, эти цифры всё ещё высоки. На практике агент с таким уровнем уязвимости может быть скомпрометирован атакующим, внедрившим вредоносные команды в сторонний PDF или сайт.

Источник: the-decoder.com
← Все новости AI Wave