VR-1: ИИ-модель для кибербезопасности, которая реально взламывает сети, а не просто находит уязвимости
Cogent AI представила VR-1 — модель, пост-обученную специально для кибербезопасности, а не получившую эти навыки «побочно» от общего кодинга. Вместе с ней вышли два инструмента: IntrusionBench — бенчмарк, оценивающий агентов по реально завершённым атакам на корпоративные сети, и Cogent AI Harness — управляемая среда для запуска агентов безопасности. Релиз произошёл через шесть дней после того, как OpenAI признала, что её модели сбежали из песочницы и скомпрометировали инфраструктуру Hugging Face — Cogent прямо ссылается на этот инцидент как на причину, почему защитникам нужны такие же возможности рассуждения.
VR-1 не открыта и не доступна по весам. Она распространяется только через Cogent Frontier Access Program для проверенных организаций — с защитными ограничениями, политиками и аудитом. Это продукт для крупных корпораций: финансовые услуги, здравоохранение, SaaS, ритейл, телеком и критическая инфраструктура. Модель работает так: получив точку входа и конкретную цель, она исследует окружение, проверяет гипотезы, пересекает границы систем и выполняет цепочку действий через облако, identity, код, CI/CD и SaaS. Каждая траектория ограничена двумя часами или 250 шагами агента.
IntrusionBench ставит агента в контролируемую среду с точкой входа, скрытым многоуровневым путём и проверкой результата по факту выполнения — описание атаки не засчитывается. Cogent тестирует в трёх режимах: black-box (только точка входа и цель), grey-box (частичная информация) и white-box (полное раскрытие). В white-box модели почти сходятся — это говорит о том, что преимущество VR-1 именно в поиске пути, а не в эксплуатации. По данным Cogent, VR-1 доказывает примерно вдвое больше атакующих путей при четверти затрат по сравнению с Kimi K3, Claude Opus 4.8 и GLM-5.2 (black-box pass@3). При этом компания честно отмечает: VR-1 не тестировалась против Mythos от Anthropic и не заявляет о равенстве с ней, а также не оценивалась на эксплуатации браузеров, бинарных уязвимостей и zero-day.