IA : Anthropic lance trois niveaux d'accès à Claude pour les équipes de cybersécurité vérifiées

Anthropic a étendu son programme de vérification cyber (Cyber Verification Program) le 6 octobre 2026, offrant aux professionnels de la sécurité agréés un accès élargi à Claude Opus 5.5, Claude Sonnet 5.5 et Claude Mythos 5.1, avec moins de contrôles de blocage liés à la cybersécurité. Cette initiative est la dernière évolution de l'actualité de l'IA visant à traiter les modèles avancés comme des outils destinés tant à la recherche défensive contrôlée qu'aux tests offensifs autorisés.
Qu'est-ce qui a changé dans le programme cyber d'Anthropic ?
Anthropic a remplacé les différents parcours d'accès par un programme à trois niveaux qui adapte les permissions des modèles au rôle d'une équipe et aux conséquences potentielles de ses travaux. L'entreprise a déclaré que la structure révisée combine son programme de vérification cyber original avec le Project Glasswing, une initiative axée sur le test de logiciels critiques.
- Accès Défense (Defense Access) : destiné à la réponse aux incidents, l'analyse de logiciels malveillants, la recherche de vulnérabilités et les travaux défensifs sur des systèmes que le demandeur possède ou maintient.
- Accès Red Team : ajoute les tests d'intrusion autorisés et les exercices de "red team". Les organisations, plutôt que les candidats individuels, sont éligibles à ce niveau.
- Accès Spécialisé (Specialized Access) : réservé à un groupe restreint testant des systèmes critiques pour la sécurité, notamment les réseaux électriques, les systèmes de vol et les infrastructures de transfert interbancaire.
Selon Anthropic, chaque niveau inclut l'accès à Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 et aux futurs modèles, bien que les mesures de protection et les exigences de vérification varient selon le niveau.
Pourquoi Anthropic réduit-il certaines mesures de protection ?
Les tests de cybersécurité peuvent ressembler à des activités malveillantes lorsqu'un système d'IA examine un malware, écrit du code d'exploitation ou sonde un réseau. Le programme d'Anthropic est conçu pour réduire les refus injustifiés pour les professionnels vérifiés, tout en conservant des contrôles sur l'identité des utilisateurs des modèles, la nature de leurs tests et la manière dont les activités à haut risque sont examinées.
L'entreprise a décrit l'extension du programme comme un moyen de mettre des capacités cyber avancées à la disposition des équipes de sécurité qualifiées. Anthropic a écrit : « Nous lançons une nouvelle version élargie de notre Cyber Verification Program (CVP), qui met des capacités cyber avancées et des classificateurs de blocage réduits à la disposition des professionnels de la sécurité qualifiés. »
Cette distinction est cruciale car un accès sans restriction pourrait aider aussi bien les défenseurs que les attaquants. Anthropic lie donc l'accès à des vérifications d'identité, à la responsabilité organisationnelle et à l'environnement prévu. La structure ne rend pas l'assistance cyber avancée disponible au grand public.
Qui peut demander un accès ?
Le groupe cible déclaré par Anthropic comprend les équipes de sécurité, les opérateurs d'infrastructures critiques, les mainteneurs de logiciels open-source et les chercheurs ayant un historique de signalement de vulnérabilités. Les candidats doivent démontrer que leurs travaux sont autorisés et qu'ils peuvent utiliser les modèles dans le respect des contrôles de sécurité requis.
- Les équipes d'opérations de sécurité et de réponse aux incidents peuvent solliciter l'accès Défense.
- Les organisations effectuant des tests d'intrusion autorisés peuvent solliciter l'accès Red Team.
- Les équipes travaillant sur des infrastructures critiques pour la sécurité sont soumises aux règles d'éligibilité les plus strictes.
- Les membres actuels du Project Glasswing passent au niveau d'Accès Spécialisé, selon la description du programme d'Anthropic.
Anthropic n'a pas déclaré publiquement combien d'organisations recevront chaque niveau ni combien de demandes elle prévoit d'approuver. L'ampleur finale du programme reste donc incertaine.
Qu'a découvert le Project Glasswing ?
Le Project Glasswing fournit la principale preuve justifiant la décision d'Anthropic d'élargir l'accès. Reuters a rapporté le 6 octobre 2026 que l'initiative avait aidé à découvrir plus de 100 000 vulnérabilités logicielles au cours de l'année 2026. Ce chiffre se rapporte aux découvertes associées au projet, et non au nombre de failles exploitables confirmées dans les infrastructures critiques.
L'effort précédent a fonctionné pendant environ six mois avant qu'Anthropic ne l'intègre au programme élargi, selon le rapport de Reuters. La propre page Glasswing d'Anthropic décrit l'initiative comme un effort pour sécuriser les logiciels critiques à l'ère de l'IA.
Cette expérience explique également le nouveau niveau spécialisé. Tester une application grand public comporte des risques différents de ceux liés au test de systèmes contrôlant l'électricité, les aéronefs ou les transferts financiers. Le cadre d'Anthropic sépare ces activités au lieu d'appliquer un niveau de permission unique à chaque chercheur en sécurité.
Comment la nouvelle structure se compare-t-elle au programme précédent ?
La version précédente couvrait Claude Opus et Claude Sonnet via un niveau d'accès unique, selon la documentation d'assistance d'Anthropic mise à jour en octobre 2026. Le cadre révisé introduit trois niveaux et ajoute Claude Mythos 5.1 à la liste des modèles disponibles.
- Ancienne structure : un seul niveau d'accès principal pour les travaux cyber vérifiés.
- Nouvelle structure : niveaux Défense, Red Team et Spécialisé.
- Accès aux modèles : Opus 5.5, Sonnet 5.5, Mythos 5.1 et les futurs modèles sont répertoriés dans les nouveaux niveaux.
- Portée du programme : l'ancien CVP et le Project Glasswing sont désormais réunis sous un seul cadre.
La conception révisée donne plus de marge de manœuvre à Anthropic pour distinguer l'analyse défensive de routine des travaux susceptibles d'affecter la sécurité publique ou la stabilité financière. Elle offre également aux organisations de sécurité une voie définie pour demander des capacités auxquelles les utilisateurs ordinaires n'ont pas accès.
Quels risques subsistent pour les équipes de sécurité ?
La réduction des contrôles de blocage peut améliorer l'utilité d'un modèle pour des tests légitimes, mais cette même capacité peut produire des instructions malveillantes si un utilisateur usurpe une autorisation. La protection du programme repose donc sur la vérification, la surveillance et la capacité du demandeur à confiner les tests à l'intérieur de systèmes approuvés.
L'Accès Spécialisé présente le potentiel d'impact le plus élevé. Anthropic affirme que les examens des travaux impliquant des systèmes critiques sont actuellement gérés en collaboration avec le gouvernement américain, selon des informations publiées par AI Weekly le 6 octobre 2026. Anthropic n'a pas divulgué l'intégralité des critères d'examen ni les agences gouvernementales impliquées.
L'accès aux modèles ne remplace pas non plus le jugement professionnel. Un exploit généré peut être inexact, dangereux ou inadapté à un environnement réel. Les équipes de sécurité ont toujours besoin de contrôles de changement, de limites de test et d'une approbation humaine avant d'appliquer les résultats du modèle aux systèmes de production.
Quelle est la suite ?
Anthropic traitera les demandes selon le modèle à trois niveaux et fera passer les participants actuels de Glasswing vers l'Accès Spécialisé. L'annonce de l'entreprise indique que de nouveaux modèles seront ajoutés au programme à l'avenir, mais elle ne fournit pas de calendrier et ne promet pas l'accès à tous les candidats.
Le prochain test sera opérationnel. Anthropic devra démontrer qu'un accès élargi améliore la découverte de vulnérabilités sans permettre d'intrusions non autorisées ou d'expérimentations dangereuses. Des rapports indépendants seront également nécessaires pour évaluer les découvertes signalées, le nombre d'équipes approuvées et tout incident de sécurité lié au programme.
Pour les défenseurs, cette expansion crée une voie contrôlée pour utiliser les modèles de pointe dans la réponse aux incidents et les tests autorisés. Pour les fournisseurs de modèles, cela soulève une question plus complexe : quelle quantité de capacités peut être libérée en toute sécurité lorsque le travail lui-même nécessite de contourner certaines des restrictions conçues pour prévenir les abus cyber ?


