Загадка про автомойку в 50 метрах: почему ИИ проваливает тест на здравый смысл
Журналисты и исследователи нашли элегантный способ проверить адекватность современных LLM: задать им вопрос про автомойку в 50 метрах от дома. Человек без раздумий ответит «пешком», а нейросети — особенно те, что обучены на формальных задачах — начинают рассуждать о маршруте на машине, забывая про абсурдность ситуации.
Этот кейс быстро превратился в неформальный бенчмарк, который прогоняют на ChatGPT, Claude, Grok, DeepSeek и других моделях. Результаты показывают: даже самые продвинутые ИИ спотыкаются на задачах, требующих элементарного здравого смысла и понимания контекста повседневной жизни.
Парадокс в том, что формально модель может дать «правильный» ответ с точки зрения логистики, но полностью игнорировать человеческую интуицию. Это напоминает старую проблему «здравого смысла» в ИИ — и загадка с автомойкой стала её наглядной иллюстрацией.