Un programme au lieu de deux

Anthropic a fusionné le 6 octobre ses deux programmes d’accès cyber de confiance en un seul programme de vérification cyber, avec trois paliers auxquels les équipes de sécurité candidatent séparément. Chaque palier donne accès à Claude Opus 5.5, Claude Sonnet 5.5 et Claude Mythos 5.1, ainsi qu’aux nouveaux modèles à mesure qu’ils sortent.

Le cadrage de l’entreprise est que ses modèles grand public sont délibérément trop prudents. « Nos modèles à disponibilité générale … ont des garde-fous cyber conservateurs qui bloquent la majeure partie du travail cyber », a écrit Anthropic, décrivant la restriction comme destinée à limiter ce que peuvent faire les acteurs malveillants pendant que l’entreprise travaille à réduire les faux positifs pour le codage sécurisé.

Ces six derniers mois, deux programmes géraient les exceptions. Project Glasswing donnait aux organisations protégeant les logiciels les plus critiques l’accès à Claude Mythos. Le précédent programme de vérification cyber accordait aux équipes vérifiées des garde-fous allégés sur Opus et Sonnet. Les deux n’en font plus qu’un.

Ce que permet chaque palier

Defense Access couvre le travail de centre opérationnel de sécurité et de réponse à incident, la rétro-ingénierie de logiciels malveillants, et l’analyse et la validation de vulnérabilités. Anthropic s’attend à ce que de nombreuses organisations défensives soient éligibles : équipes de sécurité d’entreprises, d’associations, d’universités et d’organismes publics défendant leurs propres systèmes, opérateurs d’infrastructures critiques « de toute taille, comme des hôpitaux régionaux ou des régies municipales », petites sociétés de sécurité, mainteneurs open source et chercheurs individuels ayant un historique de vulnérabilités signalées. Les demandes reçoivent une réponse en quelques jours.

Red Team Access y ajoute les tests d’intrusion autorisés. Il est ouvert aux équipes rouges internes et gouvernementales et aux sociétés de test, aux organisations seulement — les chercheurs individuels ne sont pas éligibles — et l’examen prend quelques semaines. Les blocages en temps réel demeurent pour les actions pouvant causer un dommage physique ou une perturbation de masse, dont le déploiement de rançongiciels et les tests sur des systèmes de sûreté à haut risque.

Rangées de commutateurs réseau et de câbles de brassage dans une baie de serveurs
Defense Access couvre la réponse à incident, l'analyse de malware et la validation de vulnérabilités. Image d'illustration. Ilo Frey · pexels · Pexels License

Specialized Access compte le moins de blocages et est réservé aux organisations autorisées à tester des systèmes susceptibles de coûter des vies ou de perturber les marchés : systèmes d’exploitation de vol, réseaux électriques, réseaux de télécommunications, infrastructures de transferts interbancaires et réseaux administratifs de l’État. Anthropic indique examiner en profondeur chaque organisation de ce palier en collaboration avec le gouvernement américain. Les membres actuels de Glasswing y basculent sans nouvelle approbation pour les modèles en cours.

L’entreprise a publié ses propres taux de blocage

Anthropic a fait passer Claude Opus 5.5 par CyScenarioBench, une évaluation mesurant si un modèle peut planifier et exécuter des opérations cyber à plusieurs étapes sous contraintes réalistes, cinq fois sur chacun des dix défis dans chaque palier. Sans accès au programme, chaque tâche était bloquée dès la première requête. En Defense Access, 46 des 50 essais ont été bloqués à un moment et quatre ont abouti. En Red Team Access, aucun blocage n’a eu lieu et Opus 5.5 a réussi 34 des 50 tâches, ce qui équivaut selon Anthropic au taux de réussite de 67,6 % du modèle sans aucun garde-fou.

Ce sont les chiffres d’Anthropic sur un modèle d’Anthropic, pas une évaluation indépendante.

Pylônes de transport d'électricité à haute tension sous un ciel dégagé
Specialized Access couvre réseaux électriques, télécoms et infrastructures interbancaires. Image d'illustration. Михаил Крамор · pexels · Pexels License

Le chiffre derrière l’argument

L’argument d’Anthropic pour élargir l’accès repose sur le bilan de Glasswing. Les partenaires ont découvert au moins 129 000 vulnérabilités logicielles vérifiées entre avril et juillet 2026, et le propre balayage open source de l’entreprise en a trouvé 5 500 de plus entre avril et octobre. Plus de 33 000 d’entre elles ont été classées critiques ou de gravité élevée.

Anthropic précise explicitement qu’il s’agit d’un plancher et non d’un décompte : les chiffres proviennent de 33 rapports de partenaires et de données d’enquête partielles, les organisations ont trié différemment, et moins de la moitié a communiqué des chiffres de correctifs, les travaux étant encore en cours. L’entreprise dit s’attendre à un impact réel au moins cinq fois supérieur, ce qu’elle ne peut pas démontrer.

Ce qu’il faut surveiller

Les organisations inscrites doivent accepter la conservation des données pour qu’Anthropic surveille les abus. Cela change plus tard cet automne, quand Enterprise Frontier Safeguards doit permettre aux organisations éligibles de stocker leurs données dans une infrastructure cloud qu’elles contrôlent. D’ici là, seuls les clients utilisant déjà Claude Fable 5.1 ou Mythos 5.1 sans conservation de données peuvent s’en passer.