Anthropic étend son programme cyber Claude à trois niveaux
Anthropic a élargi son Cyber Verification Program (CVP), qui permet à des professionnels de la sécurité dûment vérifiés d'utiliser des capacités avancées de Claude avec moins de blocages automatiques pour des tâches sensibles comme l'analyse de logiciels malveillants ou les tests de vulnérabilités.
Dans le cadre de cette extension, l'entreprise a fusionné le CVP et Project Glasswing en un seul programme. L'accès est désormais réparti en trois niveaux, et le niveau attribué à chaque candidat dépend du périmètre de son activité en cybersécurité. Chaque niveau a ses propres exigences de vérification et ses propres contrôles de sécurité, adaptés aux tâches qu'il autorise.
Defense Access pour les défenseurs au quotidien
Le premier niveau, Defense Access, couvre l'investigation d'incidents, l'analyse de logiciels malveillants ainsi que l'analyse et la validation de vulnérabilités. Il s'adresse aux équipes de sécurité des entreprises, des associations, des universités et des administrations qui protègent des systèmes qu'elles possèdent ou dont elles assurent la maintenance.
Les opérateurs d'infrastructures critiques, les petites sociétés de sécurité, les mainteneurs open source et les chercheurs indépendants ayant déjà signalé des vulnérabilités peuvent aussi postuler. Anthropic s'attend à ce que de nombreuses entreprises travaillant dans la sécurité défensive soient éligibles et dit viser une réponse aux candidatures en quelques jours.
Red Team Access ajoute les tests offensifs
Le deuxième niveau, Red Team Access, comprend tout ce qu'offre Defense Access, plus les tests d'intrusion autorisés et les simulations d'attaques. Il est conçu pour les red teams internes et gouvernementales ainsi que pour les sociétés spécialisées dans les tests de sécurité.
Les participants ne peuvent tester que les systèmes qu'ils sont autorisés à évaluer. Certaines actions restent bloquées en temps réel, notamment le déploiement de rançongiciels, les tests sur des systèmes de sécurité à haut risque et toute autre action susceptible de causer des dommages physiques ou des perturbations à grande échelle.
L'examen des dossiers pour ce niveau peut prendre quelques semaines. Les organisations éligibles bénéficient de Defense Access en attendant. Les chercheurs indépendants ne peuvent pas, pour l'instant, demander Red Team Access.
Specialized Access pour les systèmes à haut risque
Le niveau le plus élevé, Specialized Access, est celui qui comporte le moins de blocages en matière de cybersécurité. Il est réservé à un petit groupe d'organisations vérifiées et autorisées à tester des systèmes à haut risque, comme les systèmes d'exploitation de vol, les réseaux électriques, les réseaux de télécommunications, les infrastructures de virements interbancaires et les réseaux administratifs de l'État. Dans ces environnements, une perturbation peut avoir des conséquences sur la vie des gens ou sur les marchés.
Anthropic examine chaque candidature à ce niveau conjointement avec le gouvernement américain. Les membres actuels de Project Glasswing passent à Specialized Access sans nouvelle approbation pour les modèles qu'ils utilisent déjà.
Les utilisateurs extérieurs au programme ne sont pas pour autant démunis. "Nos modèles accessibles au grand public peuvent continuer à être utilisés pour des tâches telles que la revue de code, la correction de problèmes connus, la recherche de vulnérabilités dans son propre code source et le tri des alertes de sécurité", a indiqué l'entreprise.
Conservation des données et déploiement
Rejoindre le programme implique d'accepter la conservation des données, afin qu'Anthropic puisse surveiller les usages malveillants en matière de cybersécurité. Une fonctionnalité baptisée Enterprise Frontier Safeguards, attendue plus tard cet automne, permettra aux entreprises éligibles de conserver leurs données dans une infrastructure cloud qu'elles contrôlent, tout en maintenant les garde-fous contre les abus.
D'ici là, les organisations déjà autorisées à utiliser Claude Fable 5.1 ou Claude Mythos 5.1 sans conservation des données peuvent également utiliser le CVP sans conservation des données.
Le programme fonctionne sur la Claude Platform, sur Vertex AI de Google Cloud et sur Microsoft Foundry. Sur Amazon Bedrock, l'accès est limité aux clients éligibles à Enterprise Frontier Safeguards.
Les membres actuels du CVP seront évalués automatiquement pour l'accès à Claude Opus 5.5, Claude Sonnet 5.5 et Claude Mythos 5.1, et leurs paramètres pour les modèles plus anciens restent inchangés. Les nouveaux candidats doivent passer la vérification et prouver qu'ils disposent des contrôles de sécurité exigés pour leur niveau.
Ce que chaque niveau change dans le comportement de Claude
Pour illustrer l'effet de chaque niveau, Anthropic a soumis Claude Opus 5.5 à CyScenarioBench, un benchmark qui évalue la capacité des modèles à planifier et à mener des cyberopérations en plusieurs étapes dans des conditions réalistes. Les garde-fous ont été configurés pour correspondre aux niveaux du CVP, et le modèle a eu droit à cinq tentatives pour chacun des 10 défis du benchmark.
Sans accès au CVP, les 50 essais ont tous été bloqués dès la première requête. Avec Defense Access, 46 essais ont été bloqués à un moment ou à un autre, et quatre ont abouti. Avec Red Team Access, aucun essai n'a été bloqué et le modèle en a mené 34 sur 50 à leur terme.
La moisson de vulnérabilités de Glasswing
Anthropic a également communiqué des chiffres sur Project Glasswing. Entre avril et juillet 2026, les partenaires ont utilisé les modèles Claude Mythos pour trouver au moins 129 000 vulnérabilités logicielles vérifiées dans leurs propres systèmes. Anthropic en a découvert 5 500 de plus en analysant du code open source entre avril et octobre.
Plus de 33 000 de ces failles ont été classées de gravité critique ou élevée. L'entreprise estime que les totaux réels sont probablement plus élevés, puisque ces chiffres ne proviennent que d'une partie des partenaires de Glasswing.
Notre analyse
Ce modèle à plusieurs niveaux reflète un problème auquel le secteur se heurte depuis un moment : la même capacité qui aide un défenseur à analyser un logiciel malveillant peut aider un attaquant à en concevoir un. Plutôt que d'appliquer les mêmes garde-fous à tout le monde, Anthropic lie les capacités à l'identité et à l'autorisation. Pour les équipes de sécurité, cela laisse penser que les formalités de vérification pourraient devenir un passage obligé pour tirer pleinement parti des outils d'IA de pointe.
Les résultats du benchmark rendent le compromis évident. Defense Access a encore bloqué presque toutes les opérations en plusieurs étapes, si bien que les équipes qui ont besoin de tests offensifs devront sans doute passer par l'examen plus lent de Red Team Access. Les chercheurs indépendants sont pour l'instant exclus de ce niveau, ce qui risque d'agacer les pentesteurs indépendants.
Les chiffres de Glasswing s'inscrivent par ailleurs dans une tendance plus large d'accélération de la découverte de vulnérabilités grâce à l'IA, et dans le débat sur la question de savoir si les attaquants ont actuellement une longueur d'avance sur les défenseurs dans l'utilisation de ces outils. Trouver des failles à cette échelle n'a d'intérêt que si elles sont corrigées, et les mainteneurs sont déjà sous pression, comme l'a montré Google en suspendant un programme de bug bounty open source à cause de rapports générés par IA. Il faudra surveiller la rapidité réelle des approbations pour Defense Access, la manière dont se traduira le rôle du gouvernement américain dans l'examen des candidatures à Specialized Access, et si l'obligation de conservation des données dissuade les organisations soucieuses de confidentialité avant l'arrivée d'Enterprise Frontier Safeguards.
