Тест восьми ИИ-поисковиков: Perplexity, ChatGPT и Claude ошибаются в ссылках, но дешевле
Журналист придумал фейк о том, что Perplexity открыла офис в Москве и начала принимать карты «Мир», и скормил его восьми ИИ-моделям с веб-поиском. Все семь нейросетей (Perplexity Sonar, ChatGPT, Claude, Gemini, Grok, DeepSeek) распознали выдумку, но одна не заглянула ни в один источник, а другая пересказала чужую ошибку про блокировки аккаунтов — в первоисточнике речь шла о другом сервисе.
На простых вопросах со свежими фактами почти все ответили верно. Разница проявилась на сложных заданиях и в цене: ответ Sonar со ссылками стоил от 1,5 до 3,5 рубля, ответ Claude с поиском — до 13 рублей, а один отчёт Deep Research — 98 рублей. Автор отмечает, что сноска в ответе создаёт ложное ощущение проверенного факта, и исследования последних двух лет это подтверждают.
Тест показал, что даже модели с доступом к интернету могут давать неверные ссылки, особенно на русскоязычные запросы. В конце статьи — шаблон запроса и чек-лист для проверки ответов с источниками.