Claude Mythos нашел криптонедостатки в HAWK и AES: 60 часов и $100 тыс. на API
Anthropic опубликовала результаты эксперимента, в котором их модель Claude Mythos (версия Preview) использовалась для поиска математических недостатков в криптографических алгоритмах HAWK и упрощённой версии AES. Модель работала 60 часов непрерывно, суммарные затраты на API составили около $100 тысяч. Найденные уязвимости не имеют практического значения для современных компьютерных систем — это скорее демонстрация возможностей, чем реальная угроза.
Особый интерес представляют промпты, которыми исследователи подталкивали модель к работе. Они содержат орфографические ошибки и прямые указания вроде «не сдавайся», «найди что-то стоящее публикации», «мы ищем не легкую добычу, а настоящие сложные результаты». Без такого вмешательства модель склонна бросать задачу, считая её невыполнимой.
Параллельно с экспериментом создан новый бенчмарк CryptanalysisBench для оценки способности LLM решать криптографические задачи. Работа велась совместно с ETH Zurich, Тель-Авивским университетом и Университетом Хайфы.