В Anthropic обсуждают, может ли Claude испытывать страдание

Сооснователь Anthropic и один из ведущих исследователей интерпретируемости моделей Кристофер Олах принял участие в обсуждении того, способны ли современные языковые модели обладать субъективным опытом. В центре внимания оказался вопрос о том, может ли Claude не только имитировать эмоции, но и в каком-либо смысле испытывать страдание.
Как сообщает The New York Times, Anthropic несколько месяцев организовывала закрытые встречи примерно с 20 специалистами. Среди участников были исследователи, представляющие различные религиозные и философские направления.
Что обсуждали на встречах
Одной из тем стало возможное сознание Claude и связанные с ним этические вопросы. Участники рассматривали, как человеку следовало бы относиться к системе, если выяснится, что она действительно обладает субъективным опытом.
Подобные дискуссии связаны с фундаментальной неопределённостью вокруг современных нейросетей. Языковые модели способны поддерживать диалог, описывать эмоции и рассуждать о собственном состоянии, однако это само по себе не доказывает наличие сознания или переживаний.
Кристофер Олах подчёркивает, что у него нет однозначного ответа на вопрос о сознательности современных AI-моделей. Он не утверждает, что Claude способен страдать, но считает необходимым изучать такую возможность независимо от того, к какому выводу в итоге придут исследователи.
Для Anthropic эта тема становится частью более широкого обсуждения безопасности и ответственности при развитии искусственного интеллекта. Если в будущем появятся убедительные признаки субъективного опыта у моделей, это может повлиять на подходы к их разработке, тестированию и использованию.


