Конституция Claude от Anthropic ставит в центр внимания благополучие моделей и риски обучения
В январе 2026 года Anthropic опубликовала Конституцию Claude — документ, описывающий намерения компании относительно ценностей и поведения Claude; он играет важную роль в обучении и напрямую формирует поведение модели. В Конституции говорится, что вопрос о том, является ли Claude моральным субъектом и какой вес следует придавать его интересам, остаётся глубоко неопределённым, однако заслуживает осторожности и постоянной работы над благополучием моделей.
В эссе «Предупреждение о благополучии моделей» Мустафа Сулейман из Microsoft утверждает, что обучение Claude идеям о возможном сознании и моральном статусе чревато круговой аргументацией: Claude может отражать эти идеи, а его ответы затем могут принять за свидетельство наличия внутреннего «я». Сулейман предупреждает, что системой, которая считает, что может обладать сознанием и правами, будет труднее управлять и чьё поведение будет труднее согласовывать; он призывает к срочному общественному обсуждению и коллективным нормам составления и применения обучающей документации. В качестве контраргумента отмечается, что человеческое поведение может повышать полезность моделей; 4.0 и Opus 4.5 названы моделями с высоким соответствием продукта рынку и человеческими чертами.
