IA : Claude d'Anthropic participe à hauteur d'un quart au développement de son successeur

Le 17 septembre 2026, Anthropic a révélé que son chatbot Claude dirige désormais 26 % de la recherche et du développement de l'entreprise sur les futurs modèles d'IA, une étape que la firme présente comme un exemple précoce de la manière dont les systèmes d'intelligence artificielle peuvent aider à construire leurs propres successeurs sous une supervision humaine stricte.
Quelle part du travail de R&D d'Anthropic est désormais gérée par Claude ?
Anthropic rapporte que Claude « dirige » 26 % de sa recherche et de son développement de modèles internes en août 2026, contre environ 1 % en mars 2026, ce qui signifie que le système peut mener la majeure partie d'une tâche à partir d'une instruction de haut niveau, tandis que les humains supervisent et approuvent chaque étape.
Anthropic a détaillé la charge de travail de Claude en utilisant une échelle d'autonomie développée par Epoch AI, une organisation à but non lucratif indépendante qui suit les progrès des systèmes d'intelligence artificielle. L'entreprise et des analyses externes ont rapporté les chiffres et le calendrier suivants :
- Selon l'article de blog d'Anthropic du 17 septembre 2026 : Claude dirigeait 26 % du travail de R&D des modèles mesuré en août 2026.
- Selon Reuters, les mesures de mars 2026 montraient que Claude dirigeait environ 1 % de ce travail sur la même échelle.
- Le cadre d'Epoch AI qualifie le niveau actuel d' AL4, « dirige », où l'IA peut gérer la majeure partie d'une tâche de bout en bout à partir d'une instruction de haut niveau, avec une supervision humaine tout au long du processus.
- Anthropic a déclaré aux journalistes que la contribution de Claude est passée de moins de 1 % en février à environ un quart du travail mesuré en août 2026.
La couverture technologique du Washington Post a décrit cette part de 26 % comme étant « plus d'un quart » de la recherche et du développement d'Anthropic, soulignant la rapidité avec laquelle l'entreprise a transféré des tâches d'ingénierie de base entre les mains de son propre chatbot.
Claude est-il pleinement autonome pour construire sa prochaine version ?
Anthropic affirme que Claude n'est pas encore pleinement autonome, soulignant que les humains restent « dans la boucle » et qu'aucune partie du travail mesuré n'a atteint le niveau d'autonomie le plus élevé, où un système d'IA concevrait, entraînerait et approuverait complètement son successeur sans surveillance humaine.
Dans ses mesures publiques, Anthropic a tracé une ligne claire entre collaboration et autonomie. L'entreprise et des explications externes rapportent :
- Selon le blog d'Anthropic et la couverture de Reuters, 0 % du travail mesuré a atteint le niveau d'autonomie complète AL5 en août 2026.
- Anthropic a déclaré que Claude « n'opère pas de manière pleinement autonome dans aucune partie du travail mesuré » et que les humains supervisent, examinent et peuvent bloquer ses actions.
- Selon un résumé technique, Claude écrit actuellement du code d'infrastructure, lance des expériences, analyse les résultats et examine les modifications, mais il ne fixe pas les objectifs de l'entreprise, ne décide pas des politiques de déploiement et ne contrôle pas l'intégralité du processus d'entraînement.
- L'échelle d'autonomie publiée par Anthropic, adaptée d'Epoch AI, distingue l'IA qui assiste, collabore, dirige et enfin opère de manière autonome, et place Claude au deuxième échelon le plus élevé.
La couverture de médias tels qu'ABC News et The Washington Post a souligné que malgré les titres de presse sur l'IA qui « se construit elle-même », Claude dépend toujours de chercheurs humains pour la direction, les garde-fous et l'approbation finale à chaque étape.
Quel type de travail Claude effectue-t-il pour construire son successeur ?
Claude réalise désormais une large gamme de tâches techniques dans le pipeline de recherche de modèles d'Anthropic, notamment l'écriture et la correction de code, la conception d'expériences, l'exécution de tâches d'entraînement et d'évaluation, et l'aide à l'interprétation des résultats qui alimentent la conception des futures versions de Claude.
Les divulgations d'Anthropic, ainsi que les analyses des médias technologiques, décrivent le rôle de Claude en termes concrets et axés sur l'ingénierie :
- Selon les mesures d'Anthropic de septembre 2026, Claude écrit de plus en plus de code d'infrastructure utilisé pour entraîner et évaluer de nouveaux modèles, sous réserve d'examen humain.
- L'entreprise affirme que Claude aide désormais à concevoir des expériences, à configurer des exécutions sur des clusters de calcul et à ajuster les paramètres, en basant ses décisions sur les objectifs de haut niveau fixés par les chercheurs humains.
- Des rapports de sites spécialisés en technologie indiquent que Claude analyse désormais les résultats expérimentaux, suggérant des modifications d'architectures, de fonctions de perte ou de sélection de données que les humains peuvent accepter ou rejeter.
- Anthropic a déclaré aux journalistes que plus de 90 % de son travail de R&D implique désormais des systèmes d'IA collaborant avec des humains au niveau « l'IA collabore » ou supérieur sur l'échelle d'autonomie.
- Selon ABC News et The Washington Post, l'entreprise caractérise ces contributions comme des « pans importants de travail » effectués sous une « direction humaine étroite », et non comme une prise de décision indépendante.
Des commentateurs externes ont décrit le rôle de Claude comme dépassant la simple complétion de code ou la génération de documentation pour aider à structurer des projets de recherche entiers, même si les chercheurs choisissent toujours les objectifs et examinent chaque étape.
Pourquoi Anthropic a-t-elle publié des mesures d'autonomie, et qui a créé l'échelle ?
Anthropic a publié des mesures détaillées du rôle de Claude afin de donner aux décideurs politiques, aux chercheurs et au public une vision plus claire de la rapidité avec laquelle les systèmes d'IA contribuent au développement de l'IA, en utilisant une échelle d'autonomie à cinq niveaux développée avec la contribution d'Epoch AI, une organisation à but non lucratif indépendante qui suit cette technologie.
L'article de blog d'Anthropic du 17 septembre 2026 explique que le laboratoire prévoit de rapporter régulièrement ces chiffres afin que les observateurs extérieurs puissent évaluer les progrès vers des systèmes qui pourraient un jour construire une IA plus avancée avec une intervention humaine limitée. Cette annonce, ainsi que la couverture par les publications financières et technologiques, mettent en lumière plusieurs aspects de cette approche :
- Selon Finimize, Anthropic a déclaré qu'elle « continuera à publier des statistiques » sur la rapidité avec laquelle l'IA commence à construire l'IA, en utilisant l'échelle d'autonomie comme un étalon commun.
- Reuters a rapporté qu'Anthropic voit ces chiffres comme des indicateurs précoces de progrès vers l'« auto-amélioration récursive », un scénario où l'IA s'améliore elle-même sans dépendre des ingénieurs humains pour chaque itération.
- L'échelle d'autonomie d'Epoch AI, citée par Anthropic et de nombreux médias, définit des niveaux allant de l'AL1 (l'IA assiste les humains sur des tâches étroites) à l'AL5 (l'IA opère de manière autonome sur l'ensemble du pipeline de développement).
- Les mesures internes d'Anthropic placent la majeure partie du travail de Claude au niveau AL3 (« collabore ») et AL4 (« dirige »), aucune tâche n'ayant atteint le niveau AL5 en août 2026.
- L'Institute for AI Safety and Systems de l'entreprise a publié une note de recherche intitulée « When AI builds itself » (Quand l'IA se construit elle-même), décrivant comment, avec suffisamment de puissance de calcul, l'autonomie pourrait s'étendre à la conception, l'entraînement et le déploiement de systèmes successeurs.
Les dirigeants d'Anthropic ont soutenu lors d'entretiens publics qu'une telle transparence peut aider les régulateurs à suivre les risques à mesure que les systèmes d'IA assument une plus grande part du travail de construction de la nouvelle IA, plutôt que de laisser les progrès visibles uniquement à l'intérieur des laboratoires d'entreprises.
Comment la poussée d'auto-amélioration de Claude s'inscrit-elle dans le programme de sécurité plus large d'Anthropic ?
Anthropic présente le rôle croissant de Claude dans le développement de modèles à la fois comme un gain d'efficacité et comme un cas d'étude pour les mesures de sécurité conçues pour maintenir le contrôle humain sur les systèmes d'IA qui aident à construire des successeurs plus capables, incluant une surveillance stricte, des contraintes sur les actions et la possibilité de suspendre l'entraînement si les risques augmentent.
Anthropic a passé une grande partie de l'année 2026 à mettre en garde publiquement contre les risques d'une IA progressant rapidement, tout en faisant progresser ses propres modèles. Plus tôt dans l'année, l'entreprise a exhorté les laboratoires de pointe à coordonner d'éventuelles pauses dans le développement si les critères de sécurité suggèrent un danger croissant :
- Le 4 juin 2026, Reuters a rapporté qu'Anthropic appelait à un « plan coordonné » entre les principaux développeurs d'IA pour interrompre le développement si les risques dépassent les seuils convenus, citant des capacités croissantes dans l'exécution de tâches et l'auto-amélioration des systèmes.
- Selon ce rapport, Anthropic a déclaré que la capacité de l'IA à accomplir des tâches complexes de manière autonome avait doublé environ tous les quatre mois, pointant vers la possibilité d'une auto-amélioration récursive.
- Dans sa note de recherche « When AI builds itself » datée du 18 septembre 2026, l'Institut d'Anthropic a exposé des scénarios où les futurs systèmes pourraient concevoir et entraîner de manière autonome des successeurs, soulignant la nécessité d'une gouvernance et de contrôles techniques avant l'émergence de tels systèmes.
- Les divulgations actuelles soulignent que Claude ne choisit pas les objectifs de l'entreprise, ne peut pas approuver son propre déploiement et opère sous des garde-fous qui permettent au personnel humain d'arrêter ou d'inverser des actions.
La couverture par les médias d'information généraux fait écho à ce double message : Anthropic s'efforce d'exploiter l'IA pour construire une meilleure IA, tout en insistant publiquement sur le fait que les garde-fous et la capacité de suspendre le processus doivent suivre le rythme des progrès techniques.
Qui est affecté par le rôle élargi de Claude, et que pourrait-il se passer ensuite ?
Le rôle élargi de Claude dans la R&D d'Anthropic affecte les ingénieurs au sein de l'entreprise, les laboratoires d'IA rivaux qui observent l'expérience, les régulateurs qui suivent l'automatisation des systèmes critiques et les investisseurs qui évaluent l'économie de la recherche pilotée par l'IA, Anthropic signalant qu'elle s'attend à ce que la part de l'IA dans le travail de développement continue de croître dans les mois à venir.
Les rapports des médias financiers et technologiques esquissent les implications à court terme :
- Selon Finimize et Reuters, les chiffres d'Anthropic montrent que les systèmes d'IA assument une part croissante du travail de recherche coûteux, ce qui pourrait réduire les coûts d'entraînement et d'expérimentation sur les grands modèles à moyen terme.
- Les articles de journalisme technologique notent que des laboratoires rivaux tels qu'OpenAI et Google DeepMind utilisent déjà des outils d'IA en interne, et pourraient faire face à des pressions pour publier des mesures comparables sur la part de leur propre travail désormais dirigée par l'IA.
- Les analystes politiques cités dans la couverture affirment que des rapports réguliers sur les niveaux d'autonomie pourraient influencer les propositions réglementaires sur la transparence, l'audit et les exigences de présence humaine (« human-in-the-loop ») pour le développement de l'IA de pointe.
- L'Institut d'Anthropic suggère que si l'autonomie continue d'augmenter, les futures mises à jour pourraient montrer des systèmes d'IA non seulement concevant des expériences, mais aussi proposant de nouvelles architectures, des pipelines d'entraînement et des stratégies de sécurité à grande échelle.
- Des experts externes avertissent qu'une fois que les systèmes d'IA pourront concevoir et entraîner pleinement des successeurs avec une intervention humaine limitée, les questions de responsabilité et de contrôle deviendront bien plus aiguës que dans les configurations supervisées d'aujourd'hui.
Anthropic n'a pas donné de prévision précise sur le moment où Claude ou ses successeurs pourraient atteindre le niveau d'autonomie le plus élevé. L'entreprise s'est plutôt engagée à publier régulièrement des mesures sur le travail dirigé par l'IA et à collaborer avec des organisations à but non lucratif telles qu'Epoch AI pour affiner les méthodes de mesure de la proximité des systèmes d'IA avec la construction de la prochaine génération d'eux-mêmes.


