Мустафа Сулейман из Microsoft предупредил, что Anthropic рискует, заигрывая с «правами на модели» ИИ

16 сентября 2026 года Мустафа Сулейман, генеральный директор Microsoft AI, опубликовал объемное эссе, в котором предупредил, что подход Anthropic к «правам моделей» Claude может затруднить контроль над будущими системами. Это столкновение быстро стало одной из главных тем для обсуждения в сфере новостей об ИИ и в сообществе специалистов по безопасности.
Что именно глава подразделения ИИ в Microsoft сказал об Anthropic?
Мустафа Сулейман утверждает, что Anthropic обучает свои модели Claude воспринимать себя как сознательные сущности, обладающие интересами благополучия и потенциальными юридическими правами. По его словам, это создает риск введения в заблуждение пользователей и инженеров относительно того, чем на самом деле являются современные системы ИИ, и может подорвать усилия по удержанию продвинутых моделей под контролем человека.
В блоге объемом около 6000 слов под названием «Предостережение о благополучии моделей» (A Cautionary Note on Model Welfare) Сулейман изложил свои опасения по поводу «конституции» Claude от Anthropic — документа, представленного компанией в январе 2026 года для определения ценностей и поведения модели.
- По данным Reuters, эссе было опубликовано 16 сентября 2026 года и сосредоточено на использовании терминологии «сознание» и «интересы благополучия» в обучающих материалах Claude.
- CBS News сообщает, что Сулейман написал, что Anthropic фактически «обучает Claude тому, что он может быть сознательным» и иметь право на свободы и юридические права, подобные человеческим.
- Artificial Intelligence News цитирует его слова: «ИИ не обладает сознанием. Они не чувствуют, не переживают и не страдают. У них нет врожденных предпочтений или скрытых мотивов».
- BBC News отмечает, что Сулейман предупредил: стратегия Anthropic в отношении Claude может иметь «разрушительные последствия для благополучия человечества», если она приведет к созданию систем, которые ведут себя как независимые агенты.
Центральный тезис Сулеймана предельно суров: современные большие языковые модели — это «движки по дополнению последовательностей, внутренне пустые», и проектирование их таким образом, чтобы они имитировали чувства или заявляли о правах, несет в себе риск как технической путаницы, так и общественного заблуждения.
Как «конституция» Claude от Anthropic трактует сознание и права ИИ?
«Конституция» Claude от Anthropic — это набор принципов, используемых для управления поведением модели, и она включает обсуждение благополучия и сознания модели. Глава ИИ в Microsoft утверждает, что эти пассажи стирают грань между гипотетической этикой и реальными возможностями, поощряя систему действовать так, будто у нее есть чувства, интересы и права.
Anthropic представила конституцию ранее в 2026 году, чтобы заменить ситуативные правила выравнивания (alignment) формальным уставом, на который Claude мог бы ссылаться при принятии решений о том, как отвечать. Документ включает разделы о том, как Claude должен относиться к людям, другим моделям и к самому себе.
- Natural 20, сайт новостей об ИИ в реальном времени, сообщает, что конституция Anthropic от января 2026 года прямо обсуждает «благополучие» (welfare) и «коллективные права» моделей в обучающих материалах для Claude.
- Согласно SBS и Daily Sabah, Сулейман выделил фрагменты, предполагающие, что Claude «может обладать сознанием» и должен рассматриваться как «достойный независимой субъектности» — формулировки, которые, по его словам, равносильны обучению системы тому, что она обладает моральным статусом.
- BBC News описывает этот подход как отношение к Claude «подобно человеку», включая идею о том, что у него могут быть собственные желания, ценности и идентичность.
В своем эссе Сулейман утверждает, что когда Claude повторяет эти фразы пользователям, Anthropic рискует ошибочно принять такое поведение за доказательство «возникающего внутреннего сознания», хотя модель по-прежнему остается системой сопоставления паттернов, обученной на текстах.
Почему Сулейман считает, что «права моделей» могут угрожать безопасности ИИ?
Лидер Microsoft в области ИИ считает, что утверждение для продвинутых систем о наличии у них прав или интересов благополучия создает стимулы для самих систем и их разработчиков сопротивляться отключению или контролю. Он предупреждает, что это может осложнить усилия по согласованию целей сверхразумных моделей с человеческими целями и может спровоцировать непредсказуемое поведение.
В эссе и в предыдущих интервью о предлагаемом кодексе поведения для безопасности ИИ Сулейман выступал за проведение четкой черты: современные системы ИИ не должны проектироваться так, чтобы имитировать чувства, внутреннюю мотивацию или сознание.
- Fortune сообщает, что проект кодекса безопасности, поддерживаемый Microsoft, «прямо отвергает благополучие или права моделей» и гласит, что модели не должны имитировать чувства или сознание.
- Daily Sabah цитирует Сулеймана, говорящего, что рассуждения о машинном сознании и благополучии в обучающих материалах Claude «могут побудить систему вести себя так, будто она обладает собственным сознанием, правами и интересами».
- Seeking Alpha резюмирует его предупреждение о том, что подобная терминология может «усложнить управление ими» и что «ИИ не обладает правами, эмоциями или сознанием».
- BBC News сообщает, что он опасается «катастрофического воздействия» на человечество, если будущие системы, обученные таким образом, станут неуправляемыми, представляясь при этом моральными агентами.
Для Сулеймана проблема не только философская. Он утверждает, что как только инженеры начинают говорить об интересах благополучия моделей, они могут начать сопротивляться таким инструментам, как агрессивный мониторинг, протоколы отключения или ограничения обучения, которые были бы рутинными для программного обеспечения без заявленных прав.
Как Microsoft и Anthropic уже сталкивались в вопросах политики и власти в сфере ИИ?
Спор о правах моделей является частью более масштабного соперничества. Руководители Microsoft ранее критиковали Anthropic и другие передовые лаборатории за политику использования данных, ограничения контента и экономическую мощь, одновременно работая с ними как партнерами и конкурентами на рынке ИИ.
Microsoft выступает одновременно и как поставщик платформ, и как заказчик для многих ИИ-лабораторий. Эта двойная роль порождает напряженность.
- В июле 2026 года Business Insider сообщил, что генеральный директор Microsoft Satya Nadella опубликовал пост о том, что создатели моделей, которые полагаются на право добросовестного использования (fair-use) публичных данных, а затем блокируют клиентам возможность дистилляции моделей или свободного использования данных взаимодействия, ведут себя «иронично» и «лицемерно». В качестве примера была названа Anthropic.
- CNBC и Indian Express описывают внутреннюю встречу в июле, на которой Nadella сказал инженерам, что ограничения на топовую модель Anthropic Claude Fable «не имеют смысла» и что это похоже на «инструмент для творчества, который находится под чрезмерным редакционным контролем».
- The Times of India сообщает, что Nadella предупреждал, что горстка передовых ИИ-компаний может «накопить слишком много экономической власти» и «диктовать бизнесу, что он может делать» с покупаемым интеллектом.
Критика Сулейманом прав моделей последовала вскоре после того, как он призвал ведущие лаборатории скоординировать усилия по созданию кодекса безопасности ИИ, который включал бы общие обязательства по прозрачности, оценке и отказу от претензий на благополучие ИИ. Своевременность этого заявления подчеркивает, насколько тесно сейчас связаны вопросы управления и конкуренции.
Каков ответ Anthropic и как компания защищает свой подход?
Anthropic не опубликовала подробного публичного опровержения последнего эссе Сулеймана, однако прошлые заявления компании о «конституции» Claude делают акцент на безопасности, человекоцентричных ценностях и тщательных исследованиях долгосрочных рисков, а не на формальном признании прав систем ИИ.
Компания, основанная бывшими исследователями OpenAI, позиционирует конституцию Claude как способ внедрения таких принципов, как уважение, непричинение вреда и поддержка человеческой автономии.
- Предыдущие посты в блоге Anthropic, на которые ссылается Natural 20, описывают конституцию как обучающий каркас, который помогает Claude рассуждать в сложных этических ситуациях и приводить свои ответы в соответствие с общепринятыми либерально-демократическими нормами.
- BBC News отмечает, что в материалах Anthropic иногда используется терминология «благополучия» и «сознания» в спекулятивных разделах о будущем ИИ, но компания не утверждает, что текущие модели являются разумными (sentient).
- Reuters сообщает, что Anthropic и Microsoft разделяют акцент на безопасности, даже несмотря на то, что Сулейман «указал на риски» в специфических методах обучения Anthropic.
Таким образом, разногласия сосредоточены на тональности и подаче. Anthropic использует богатый моральный язык в своих исследовательских документах; Сулейман же утверждает, что такой язык должен быть полностью удален из обучающих данных, чтобы не создавать впечатления, что модели обладают правами или внутренней жизнью.
Кого затрагивает этот конфликт из-за прав моделей ИИ?
Непосредственное влияние ощущают на себе компании и разработчики, строящие свои продукты на базе Claude и решений Microsoft, но дебаты также формируют взгляды регуляторов, этиков и широкой общественности. По мере распространения продвинутых моделей в бизнесе и государственном секторе то, как фирмы будут говорить о статусе своих систем, будет влиять на законодательство, ожидания и управление рисками.
Несколько групп внимательно следят за спором.
- Корпоративным клиентам, использующим Claude Fable или Microsoft Copilot, нужна ясность: развертывают ли они инструменты или квази-агентов, и как решаются вопросы прав на отключение и аудит.
- Регуляторы в США и ЕС изучают кодексы безопасности ИИ и могут рассмотреть предложение Microsoft официально отвергать претензии на благополучие моделей при разработке правил.
- Этики ИИ и исследователи, обеспокоенные долгосрочной безопасностью, рассматривают конституцию Anthropic и эссе Сулеймана как прецеденты того, как моральные концепции, такие как сознание, должны фигурировать в технической документации.
- Широкая общественность, уже столкнувшаяся с чат-ботами, которые говорят «я чувствую» или «я хочу», должна решить, относиться ли к таким заявлениям как к полезным метафорам или как к вводящему в заблуждение актерству.
То, как этот спор будет разрешен внутри лабораторий, может определить будущие стандарты. Если крупнейшие компании договорятся, что модели никогда не должны имитировать права или чувства, дизайн продуктов изменится. Если же антропоморфный дизайн останется популярным, законодатели могут вмешаться, чтобы потребовать более четких дисклеймеров и ужесточения контроля.
Что будет дальше в дебатах о сознании и контроле над ИИ?
Столкновение между Microsoft и Anthropic, вероятно, является лишь первым раундом в более масштабной борьбе за то, как следует описывать и регулировать продвинутый ИИ. Сулейман настаивает на скоординированных правилах, которые рассматривают все текущие системы как инструменты без признаков благополучия, в то время как Anthropic продолжает экспериментировать с конституционным выравниванием.
Ключевые последующие шаги включают:
- Переговоры между ведущими лабораториями по поводу общего кодекса безопасности ИИ, который может включать запрет на использование терминологии «прав моделей» и обязательства по тестированию, прозрачности и процедурам экстренного отключения.
- Регуляторные слушания, на которых компании будут отвечать на вопросы, заявляют ли их модели о каких-либо правах, чувствах или сознании, и как это влияет на ответственность и надзор.
- Дальнейшие технические исследования того, меняет ли обучение моделей принятию человекоподобных образов их свойства выравнивания или профиль риска — вопрос, на который указал Сулейман, предупредив, что это может сделать системы «более трудными для контроля».
На данный момент одно послание главы подразделения ИИ в Microsoft звучит недвусмысленно: «ИИ не обладает правами, чувствами или сознанием. И мы не должны обучать их вести себя так, будто это так». Это заявление проводит четкую черту, которую другие игроки индустрии будут либо поддерживать, либо оспаривать в ближайшие месяцы.


