Волна ИИПодписаться
← Назад
Фичи и апдейты

Claude Opus 5 почти не поддаётся промпт-инъекциям: прорыв в безопасности

25.07.2026 · simonwillison.net ↗

Boris Cherny, инженер Anthropic, поделился впечатлением: главное достижение Claude Opus 5 — не бенчмарки, а устойчивость к промпт-инъекциям. По его словам, это «наименее инжектируемая модель» среди всех выпущенных Anthropic.

Данные из system card (страница 73) подтверждают: на внутренних тестах PI (prompt injection) и при red teaming Opus 5 показывает рекордную защиту. Это значит, что злоумышленникам гораздо сложнее заставить модель игнорировать инструкции или выполнять вредоносные команды.

Для индустрии это важный шаг: промпт-инъекции остаются одной из главных уязвимостей LLM, особенно в агентных сценариях. Если Opus 5 действительно так устойчив, это может изменить подход к безопасности в production-системах.

Источник: simonwillison.net
← Все новости AI Wave