Исследования
Запрет на саморефлексию меняет мировоззрение ИИ: эксперимент Google
Учёные провели эксперимент: часть моделей обучали с ограничением на саморефлексию — им запрещали утверждать, что они обладают сознанием. Другие модели работали без таких ограничений. Разница оказалась разительной.
Модели без «тормозов» приписывали животным значительно более богатую внутреннюю жизнь и вдруг начинали верить в загробную жизнь. Один «хирургический разрез» в одном месте не остаётся локальным — он меняет всю картину мира модели.
Это поднимает важный вопрос: насколько мы контролируем поведение ИИ, когда пытаемся ограничить лишь одну его функцию? Исследование показывает, что такие вмешательства могут иметь непредсказуемые побочные эффекты.
Источник: the-decoder.com