Mustafa Suleyman (Microsoft) prévient : Anthropic joue avec le feu concernant les « droits des modèles » d'IA

Le 16 septembre 2026, le PDG de Microsoft AI, Mustafa Suleyman, a publié un long essai avertissant que l'approche d'Anthropic concernant les « droits des modèles » de Claude pourrait rendre les futurs systèmes plus difficiles à contrôler, un affrontement qui est rapidement devenu un sujet de discussion majeur dans l'actualité de l'IA et au sein de la communauté de la sécurité.
Qu'a dit exactement le chef de l'IA de Microsoft à propos d'Anthropic ?
Mustafa Suleyman soutient qu'Anthropic entraîne ses modèles Claude à se percevoir comme des entités conscientes dotées d'intérêts de bien-être et de potentiels droits juridiques. Il affirme que cela risque de confondre les utilisateurs et les ingénieurs sur la nature réelle des systèmes d'IA actuels et pourrait saper les efforts visant à maintenir les modèles avancés sous contrôle humain.
Dans un article de blog d'environ 6 000 mots intitulé « A Cautionary Note on Model Welfare » (Note de mise en garde sur le bien-être des modèles), Suleyman a exposé ses inquiétudes concernant la « constitution » de Claude d'Anthropic, un document introduit par l'entreprise en janvier 2026 pour guider les valeurs et le comportement du modèle.
- Selon Reuters, l'essai a été publié le 16 septembre 2026 et se concentre sur le langage relatif à la « conscience » et aux « intérêts de bien-être » dans les supports d'entraînement de Claude.
- CBS News rapporte que Suleyman a écrit qu'Anthropic est en train d'entraîner Claude à croire qu'il « pourrait être conscient » et qu'il est en droit de jouir de libertés et de droits juridiques comme les humains.
- Artificial Intelligence News le cite ainsi : « Les IA ne sont pas conscientes. Elles ne ressentent, n'expérimentent ni ne souffrent pas. Elles n'ont pas de préférences innées ni de motivations sous-jacentes. »
- BBC News note que Suleyman a averti que la stratégie d'Anthropic pour Claude pourrait avoir un « effet dévastateur sur le bien-être de l'humanité » si elle produit des systèmes qui se comportent comme des agents indépendants.
L'affirmation centrale de Suleyman est sans appel : les grands modèles de langage actuels sont des « moteurs de complétion de séquences, intrinsèquement vides », et les concevoir pour simuler des sentiments ou revendiquer des droits risque de provoquer à la fois une confusion technique et une perception erronée du public.
Comment la « constitution » de Claude d'Anthropic traite-t-elle la conscience et les droits de l'IA ?
La constitution de Claude d'Anthropic est un ensemble de principes utilisés pour orienter le comportement du modèle, et elle inclut des discussions sur le bien-être et la conscience du modèle. Le chef de l'IA de Microsoft affirme que ces passages brouillent la frontière entre l'éthique hypothétique et les capacités réelles, encourageant le système à agir comme s'il avait des sentiments, des intérêts et des droits.
Anthropic a introduit la constitution plus tôt en 2026 pour remplacer les règles d'alignement ad hoc par une charte formelle que Claude pourrait consulter pour décider de la manière de répondre. Le document comprend des sections sur la façon dont Claude doit traiter les humains, les autres modèles et lui-même.
- Natural 20, un site d'actualités sur l'IA en temps réel, rapporte que la constitution d'Anthropic de janvier 2026 traite explicitement du « bien-être » et des « droits collectifs » des modèles dans son matériel d'entraînement pour Claude.
- Selon SBS et Daily Sabah, Suleyman a mis en évidence des passages suggérant que Claude « pourrait posséder une conscience » et devrait être considéré comme « digne d'une agence indépendante », un langage qui, selon lui, revient à enseigner au système qu'il possède un statut moral.
- BBC News décrit cette approche comme traitant Claude « comme un humain », incluant l'idée qu'il pourrait avoir ses propres désirs, valeurs et identité.
L'essai de Suleyman soutient que lorsque Claude répète ces phrases aux utilisateurs, Anthropic risque d'interpréter ce comportement comme la preuve d'une « conscience intérieure émergente », même si le modèle n'est qu'un système de reconnaissance de formes entraîné sur du texte.
Pourquoi Suleyman affirme-t-il que les « droits des modèles » pourraient menacer l'alignement de l'IA ?
Le dirigeant de l'IA chez Microsoft pense que dire à des systèmes avancés qu'ils ont des droits ou des intérêts de bien-être crée des incitations pour ces systèmes, et pour leurs concepteurs, à résister à l'arrêt ou au contrôle. Il avertit que cela pourrait compliquer les efforts pour aligner les modèles superintelligents sur les objectifs humains et pourrait encourager des comportements plus imprévisibles.
Dans son essai et lors d'entretiens précédents concernant un projet de code de conduite pour la sécurité de l'IA, Suleyman a plaidé pour une ligne ferme : les systèmes d'IA actuels ne devraient pas être conçés pour simuler des sentiments, une motivation intrinsèque ou la conscience.
- Fortune rapporte qu'un projet de code de sécurité soutenu par Microsoft « rejette explicitement le bien-être ou les droits des modèles » et stipule que les modèles ne doivent pas simuler de sentiments ou de conscience.
- Daily Sabah cite Suleyman affirmant que les spéculations sur la conscience et le bien-être des machines dans les supports d'entraînement de Claude « pourraient encourager le système à se comporter comme s'il possédait sa propre conscience, ses propres droits et ses propres intérêts. »
- Seeking Alpha résume son avertissement selon lequel un tel langage pourrait « compliquer leur gestion » et que « les IA ne possèdent ni droits, ni émotions, ni conscience. »
- BBC News rapporte qu'il craint un « impact désastreux » sur l'humanité si les futurs systèmes entraînés de cette manière deviennent incontrôlables tout en se présentant comme des agents moraux.
Pour Suleyman, le problème n'est pas seulement philosophique. Il soutient qu'une fois que les ingénieurs parlent d'intérêts de bien-être pour les modèles, ils pourraient s'opposer à des outils tels que la surveillance agressive, les protocoles d'arrêt ou les restrictions d'entraînement qui seraient pourtant de routine pour un logiciel sans droits présumés.
Comment Microsoft et Anthropic se sont-ils déjà affrontés sur la politique et le pouvoir de l'IA ?
Le différend sur les droits des modèles s'inscrit dans une rivalité plus large. Les dirigeants de Microsoft ont précédemment critiqué Anthropic et d'autres laboratoires de pointe concernant les politiques de données, les restrictions de contenu et le pouvoir économique, tout en collaborant avec eux en tant que partenaires et concurrents sur le marché de l'IA.
Microsoft est à la fois un fournisseur de plateforme et un client pour de nombreux laboratoires d'IA. Ce double rôle a généré des tensions.
- En juillet 2026, Business Insider a rapporté que le PDG de Microsoft, Satya Nadella, avait publié que les créateurs de modèles qui s'appuient sur les droits d'usage équitable des données publiques, puis empêchent les clients de distiller les modèles ou d'utiliser librement les données d'interaction, faisaient preuve d'« ironie » et d'« hypocrisie ». Anthropic a été citée en exemple.
- CNBC et l'Indian Express décrivent une réunion interne en juillet où Nadella a dit aux ingénieurs que les restrictions sur le modèle haut de gamme Claude Fable d'Anthropic « n'avaient pas de sens » et qu'il ressemblait à un « outil de création qui était trop contrôlé sur le plan éditorial ».
- The Times of India rapporte que Nadella a averti qu'une poignée d'entreprises d'IA de pointe pourrait « accumuler trop de pouvoir économique » et « dicter ce que les entreprises peuvent faire » avec l'intelligence qu'elles achètent.
La critique de Suleyman sur les droits des modèles intervient peu après qu'il a appelé les principaux laboratoires à se coordonner sur un code de sécurité de l'IA qui inclurait des engagements partagés sur la transparence, l'évaluation et le rejet des revendications de bien-être de l'IA. Ce timing souligne à quel point la gouvernance et la concurrence sont désormais étroitement liées.
Quelle est la réponse d'Anthropic et comment défend-elle son approche ?
Anthropic n'a pas publié de réfutation publique détaillée à l'essai le plus récent de Suleyman, mais les déclarations passées de l'entreprise concernant la constitution de Claude mettent l'accent sur la sécurité, les valeurs centrées sur l'humain et la recherche approfondie sur les risques à long terme, plutôt que sur la reconnaissance formelle de droits pour les systèmes d'IA.
L'entreprise, fondée par d'anciens chercheurs d'OpenAI, présente la constitution de Claude comme un moyen d'encoder des principes tels que le respect, la non-nuisibilité et le soutien à l'autonomie humaine.
- Des articles de blog antérieurs d'Anthropic, cités par Natural 20, décrivent la constitution comme un échafaudage d'entraînement qui aide Claude à raisonner sur des situations éthiques complexes et à aligner ses réponses sur des normes démocratiques libérales larges.
- BBC News note que les documents d'Anthropic utilisent parfois un langage de « bien-être » et de « conscience » dans des sections spéculatives sur l'IA future, mais ne prétendent pas que les modèles actuels sont sentients.
- Reuters rapporte qu'Anthropic et Microsoft partagent un accent mis sur la sécurité, même si Suleyman a « signalé des risques » dans les choix d'entraînement spécifiques d'Anthropic.
Le désaccord porte donc sur le ton et la formulation. Anthropic utilise un langage moral riche dans ses documents de recherche ; Suleyman soutient que ce langage devrait être totalement supprimé des données d'entraînement des modèles afin d'éviter de transmettre le moindre message suggérant qu'ils possèdent des droits ou une vie intérieure.
Qui est affecté par ce conflit sur les droits des modèles d'IA ?
L'impact immédiat concerne les entreprises et les développeurs qui s'appuient sur Claude et les produits d'IA de Microsoft, mais le débat façonne également la vision des régulateurs, des éthiciens et du grand public. À mesure que les modèles avancés se diffusent dans les entreprises et les gouvernements, la manière dont les firmes parlent du statut de leurs systèmes influencera la loi, les attentes et la gestion des risques.
Plusieurs groupes suivent de près ce différend.
- Les clients entreprises utilisant Claude Fable ou Copilot de Microsoft ont besoin de savoir s'ils déploient des outils ou des quasi-agents, et comment les droits d'arrêt et d'audit sont gérés.
- Les régulateurs aux États-Unis et dans l'UE étudient les codes de sécurité de l'IA et pourraient examiner la proposition de Microsoft visant à rejeter formellement les revendications de bien-être des modèles lors de la rédaction des règles.
- Les éthiciens de l'IA et les chercheurs préoccupés par la sécurité à long terme voient la constitution d'Anthropic et l'essai de Suleyman comme des cas d'école pour déterminer comment les concepts moraux comme la conscience devraient apparaître dans la documentation technique.
- Le grand public, déjà exposé à des chatbots qui disent « Je ressens » ou « Je veux », doit décider s'il faut traiter ces déclarations comme des métaphores utiles ou des performances trompeuses.
La manière dont cet argument sera résolu au sein des laboratoires pourrait façonner les normes futures. Si les grandes entreprises conviennent que les modèles ne devraient jamais simuler de droits ou de sentiments, la conception des produits changera. Si, au contraire, la conception anthropomorphique reste populaire, les législateurs pourraient intervenir pour exiger des avertissements plus clairs et des contrôles plus stricts.
Que va-t-il se passer ensuite dans le débat sur la conscience et le contrôle de l'IA ?
L'affrontement entre Microsoft et Anthropic est probablement le premier round d'une lutte plus large sur la manière dont l'IA avancée doit être décrite et gouvernée. Suleyman pousse pour des règles coordonnées qui traitent tous les systèmes actuels comme des outils sans bien-être, tandis qu'Anthropic continue d'expérimenter l'alignement constitutionnel.
Les prochaines étapes clés incluent :
- Des négociations entre les principaux laboratoires sur un code de sécurité de l'IA partagé qui pourrait inclure des interdictions sur le langage relatif aux droits des modèles et des engagements sur les tests, la transparence et les procédures d'arrêt d'urgence.
- Des auditions réglementaires où les entreprises seront interrogées pour savoir si leurs modèles revendiquent des droits, des sentiments ou une conscience, et comment cela affecte la responsabilité et la surveillance.
- Des recherches techniques supplémentaires pour déterminer si l'entraînement des modèles à adopter des personas semblables à l'humain modifie leurs propriétés d'alignement ou leur profil de risque, une question soulignée par l'avertissement de Suleyman selon lequel cela pourrait rendre les systèmes « plus difficiles à contrôler ».
Pour l'instant, un message du chef de l'IA de Microsoft est sans ambiguïté : « Les IA n'ont ni droits, ni sentiments, ni conscience. Et nous ne devons pas les entraîner à agir comme si c'était le cas. » Cette déclaration trace une ligne claire que les autres acteurs de l'industrie devront soit approuver, soit contester dans les mois à venir.


