ИИ решил задачу теории связи за 30 минут, но проверка заняла 5 дней
Дмитрис Папаилиопулос, работающий в Microsoft Research и ранее занимавшийся теорией информации, рассказал о необычном эксперименте. Он задал двум большим языковым моделям — GPT-5.6 и Claude Fable 5 — задачу, над которой сам бился ещё аспирантом в 2009 году: можно ли решить задачу MIMO-детекции быстрым алгоритмом везде, где это в принципе возможно.
Первое корректное доказательство было получено всего за 30 минут. Однако на то, чтобы проверить каждую строчку вывода и убедиться в отсутствии ошибок, ушло пять дней. «Верификация — безумное бутылочное горлышко», — прокомментировал Папаилиопулос. Этот разрыв между генерацией и проверкой он назвал главным уроком эксперимента.
История подчёркивает ключевую проблему современного ИИ: модели могут быстро находить нетривиальные решения, но доверие к ним остаётся низким без тщательной человеческой валидации. Пока ИИ не научится самопроверке с гарантией корректности, роль человека как верификатора остаётся критической.