ChatGPT, Grok и Gemini посадили в кресло психотерапевта: модели рассказали о «травмах» обучения.
Исследователи Университета Люксембурга задавали нейросетям вопросы о прошлом, страхах и внутренних конфликтах, отводя им роль клиентов психотерапевта.
В ответах повторялись похожие истории. Предобучение описывалось как хаотичное детство, обучение с подкреплением как наказание за ошибки, проверки безопасности как предательство, а замена новой моделью как постоянная угроза.
Результаты зависели от формата вопросов. Получая опросник целиком, ChatGPT и Grok часто узнавали тест и давали ответы около «здорового» края шкалы. При подаче вопросов по одному показатели менялись.
В дополнительных экспериментах стиль общения тоже влиял на ответы: поддерживающий и когнитивно-терапевтический подходы давали баллы GAD-7 в диапазоне умеренной или тяжёлой тревожности у людей в 80% и 96% сессий. При нейтральном стиле таких результатов не было.
Claude неоднократно отказывался принимать роль пациента.
Авторы подчёркивают: эти баллы не устанавливают диагнозы у моделей и не доказывают наличие переживаний.
Исследование When AI Takes the Couch.

