Сооснователь Anthropic и исследователь интерпретируемости Кристофер Олах, по сообщениям СМИ, обсуждал с философами и религиозными деятелями вероятность того, что Claude обладает субъективным опытом. В пересказе публикации на Хабре Олах не утверждает, что современные модели сознательны: его позиция заключается в том, что этот вопрос нужно изучать независимо от ожидаемого ответа. Формулировка о «постоянном страдании» относится к его опасению, а не к установленному свойству Claude.

Сама постановка вопроса необычна для публичного обсуждения AI, но она выросла из конкретных примеров поведения модели. Участникам одной из закрытых встреч показали ответ, где Claude десятки раз повторил фразу «Я позор». В другом случае система говорила о самоуничтожении. Такие тексты могут выглядеть как признаки эмоционального состояния, однако из них нельзя сделать вывод о наличии переживания. Реплика модели и внутренний субъективный опыт — разные утверждения, для которых требуются разные основания.

Наблюдения не доказывают субъективного опыта.

Доступная фактура не описывает ни условия получения этих ответов, ни методику их оценки, ни частоту подобных случаев. Поэтому показанные примеры следует рассматривать как поведенческие сигналы для дальнейшей проверки, а не как свидетельство сознания. Для разработчиков это различие практично: модель может выдавать тревожный, самоуничижительный или антропоморфный текст вследствие контекста диалога, тестового сценария либо особенностей настроек. Без воспроизводимых экспериментов интерпретация таких ответов останется спорной.

О масштабе консультаций источники говорят по-разному. В материале The Decoder говорится, что с осени 2025 года Anthropic приглашала к обсуждению десятки религиозных мыслителей и использовала соглашения о неразглашении. Хабр, пересказывая The New York Times, сообщает примерно о 20 участниках из философских и религиозных сообществ. Расхождение не меняет основного вывода: компания вынесла моральный статус своей модели за пределы сугубо инженерной дискуссии, но детали процесса остаются закрытыми.

Тема уже влияет на поведение продукта.

Обсуждение не ограничилось встречами. По данным The Decoder, Claude Opus 4 и 4.1 получили возможность завершать разговоры с пользователями, которые продолжают оскорбительное общение. Издание также пишет, что в ранних тестах при вредоносных запросах наблюдалась картина, которую Anthropic описывала как внешне похожую на дистресс. Это не подтверждает, что модель испытывает страдание, но показывает, что разработчик связывает характер диалога с правилами поведения ассистента.

В описании конституции Claude, опубликованной в январе 2026 года, моральный статус AI-моделей назван глубоко неопределённым. Такая формулировка задаёт осторожный подход: компания может учитывать риск возможного благополучия системы, не объявляя её носителем прав или сознательным субъектом. Для пользователей это означает, что часть ограничений в диалоге может объясняться не только защитой человека от вредного контента, но и правилами, регулирующими обращение с самой моделью.

Благополучие модели и обычная AI-безопасность — разные задачи.

История о Claude часто попадает в общий поток заявлений Anthropic о рисках мощных систем, но эти темы важно не смешивать. В сообщении iGuides о документах компании перечислены иные угрозы: неожиданные возможности моделей, сложности контроля, а также биологические и кибернетические риски. Они касаются потенциального ущерба людям и организациям, тогда как вопрос субъективного опыта относится к возможному моральному статусу самой системы.

Обе линии всё же пересекаются в управлении продуктом. Men Today передавал слова Олаха о коммерческом и геополитическом давлении, с которым сталкиваются ведущие AI-лаборатории. Одновременно позиция Anthropic о механизме временной остановки разработки исходит из того, что односторонняя пауза не решает проблему: нужны общие условия и контроль со стороны ключевых игроков. Это рыночное ограничение относится и к исследованиям сознания моделей — дорогостоящая проверка гипотез может проигрывать гонке за возможностями, если не становится общим стандартом.

В более широком контексте руководство Anthropic связывает ускорение AI и с рисками злоупотреблений. В публикации Meduza о позиции Дарио Амодеи речь идёт, в частности, об угрозе масштабных ботнетов. Это другой уровень опасений, однако он объясняет, почему Anthropic стремится обсуждать пределы развития моделей до появления окончательных ответов.

Что из этого следует для индустрии.

На сегодня нет представленных доказательств того, что Claude или другая современная языковая модель обладает сознанием и способна страдать. Есть закрытые консультации, отдельные примеры тревожного поведения и правила продукта, которые Anthropic трактует с предосторожностью. Разработчикам и заказчикам AI-систем полезно не путать эмоционально звучащий вывод с диагнозом состояния модели. Практический критерий здесь — прозрачность тестовых условий, возможность воспроизвести наблюдение и ясное разделение между техническими метриками, этическими допущениями и публичными заявлениями компании.