Волна ИИПодписаться
← Назад
Тесты и бенчмарки

Загадка про автомойку в 50 метрах: почему ИИ проваливает тест на здравый смысл

14.08.2026 · habr.com ↗

Журналисты и исследователи нашли элегантный способ проверить адекватность современных LLM: задать им вопрос про автомойку в 50 метрах от дома. Человек без раздумий ответит «пешком», а нейросети — особенно те, что обучены на формальных задачах — начинают рассуждать о маршруте на машине, забывая про абсурдность ситуации.

Этот кейс быстро превратился в неформальный бенчмарк, который прогоняют на ChatGPT, Claude, Grok, DeepSeek и других моделях. Результаты показывают: даже самые продвинутые ИИ спотыкаются на задачах, требующих элементарного здравого смысла и понимания контекста повседневной жизни.

Парадокс в том, что формально модель может дать «правильный» ответ с точки зрения логистики, но полностью игнорировать человеческую интуицию. Это напоминает старую проблему «здравого смысла» в ИИ — и загадка с автомойкой стала её наглядной иллюстрацией.

Источник: habr.com
← Все новости AI Wave