ИИ проваливает тесты на IQ: пройди головоломки, которые не поддались нейросетям
Головоломки и тесты — классический способ оценить, как прогрессирует ИИ. Если в конце 2024 года лучшие модели решали лишь 18% головоломок New York Times Connections, то к началу 2025-го некоторые справляются почти идеально. Но есть задачи, на которых нейросети стабильно буксуют.
Пространственное мышление: ИИ проваливает тесты на мысленный поворот 3D-объектов — у него нет интуиции архитектора или инженера. Память против адаптивности: модели, натренированные на классических загадках (например, «Рыцари и лжецы»), не замечают ключевых изменений в похожей, но новой задаче. «SimpleBench» — аналогичный случай: люди видят подвох, а топ-модели допускают глупые ошибки. Абстрактное и визуальное: на бенчмарке ARC-AGI, где нужно вывести общее правило из примеров на сетках, двухмерные схемы тоже ставят ИИ в тупик.
Каждая головоломка в подборке подсвечивает разницу между машинным и человеческим познанием. Если пройдёте все — покажете, что пока можете переиграть ИИ в уме.