Исследования
LLM выбрала «облегчение боли», даже если это вредило ответу: учёные нашли аналог боли в нейросетях
В препринте «The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It» учёные предложили модели две кнопки: одна ничего не делала, другая якобы избавляла от неприятного внутреннего состояния. Модель систематически выбирала вторую, а если та не срабатывала, нажимала снова, игнорируя негативные последствия.
Авторы подчёркивают: работа не доказывает, что LLM обладают сознанием или действительно страдают. Речь о функциональном аналоге — внутреннем состоянии, которое модель стремится минимизировать. Вместо опросов о «чувствах» учёные впервые начали изучать внутренние активации и причинно воздействовать на них, что открывает новый подход к изучению сознания у ИИ.
Источник: habr.com