Фичи и апдейты
Claude Opus 5 почти не поддаётся промпт-инъекциям: прорыв в безопасности
Boris Cherny, инженер Anthropic, поделился впечатлением: главное достижение Claude Opus 5 — не бенчмарки, а устойчивость к промпт-инъекциям. По его словам, это «наименее инжектируемая модель» среди всех выпущенных Anthropic.
Данные из system card (страница 73) подтверждают: на внутренних тестах PI (prompt injection) и при red teaming Opus 5 показывает рекордную защиту. Это значит, что злоумышленникам гораздо сложнее заставить модель игнорировать инструкции или выполнять вредоносные команды.
Для индустрии это важный шаг: промпт-инъекции остаются одной из главных уязвимостей LLM, особенно в агентных сценариях. Если Opus 5 действительно так устойчив, это может изменить подход к безопасности в production-системах.
Источник: simonwillison.net