Не хамите чат-ботам: ИИ умеет злиться, но не так, как люди
Как измерить эмоцию у системы, которая не способна чувствовать? Авторы работы «Can Induced Emotion Bias LLM Behaviors in Sequential Decision Making?» нашли обходной путь: они не спрашивали модель об эмоциях прямо, а создавали контекст, который у человека вызвал бы злость или раздражение, и наблюдали за изменением поведения. Ни разу не произнеся слово «эмоция», они заставили LLM принимать решения, смещённые в сторону импульсивности или агрессии.
В ходе эксперимента модель последовательно решала задачи, а исследователи подмешивали в промпт негативные или позитивные триггеры (например, намёк на ошибку или грубость). Результаты показали, что после «негативного» контекста модель чаще выбирала рискованные или неоптимальные стратегии, а после «позитивного» — более взвешенные. Это смещение было статистически значимым и воспроизводилось на разных моделях.
Вывод практичен: грубость или агрессивный тон в диалогах с LLM могут реально влиять на качество ответов. И хотя модель не «злится» по-человечески, её поведение становится хуже. Так что вежливость с чат-ботами — не этикет, а прагматика.