Anthropic ouvre davantage Claude aux usages cyber défensifs

Anthropic élargit son Cyber Verification Program et regroupe plusieurs accès en trois niveaux. L’objectif: laisser les défenseurs tester, corriger et analyser plus vite, tout en gardant des blocages sur les usages à risque.

Anthropic a annoncé le 6 octobre 2026 un Cyber Verification Program élargi, qui donne à des professionnels de la cybersécurité un accès encadré à Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 et aux modèles à venir. Le programme est structuré en trois niveaux d’accès, avec des garde-fous qui varient selon le type de travail autorisé. En clair, l’éditeur veut aider les défenseurs sans offrir une boîte à outils trop confortable aux attaquants.

Trois niveaux pour séparer défense, tests autorisés et systèmes critiques

Le nouveau dispositif fusionne deux mécanismes déjà en place sur les six mois précédents: Project Glasswing, destiné aux organisations qui protègent des logiciels critiques, et le Cyber Verification Program initial, qui donnait un accès réduit aux filtres de sécurité sur Claude Opus et Claude Sonnet. Anthropic parle désormais d’un ensemble unique avec trois tiers: Defense Access, Red Team Access et Specialized Access. Chaque niveau ouvre plus ou moins les protections selon l’usage déclaré.

Defense Access couvre les tâches défensives, comme les opérations de centre de sécurité, la réponse à incident, l’ingénierie inverse de malwares ou l’analyse de vulnérabilités. Red Team Access ajoute les tests d’intrusion autorisés et les exercices de red team sur des systèmes que l’organisation est habilitée à tester. Specialized Access, enfin, est réservé à un petit nombre d’organisations vérifiées qui testent des systèmes susceptibles d’affecter des vies ou de perturber des marchés, comme l’aviation, les réseaux électriques, les télécoms ou l’infrastructure interbancaire.

Anthropic précise que les utilisateurs de ses modèles grand public gardent déjà des usages cyber limités, comme la revue de code, la correction de failles connues, la recherche de vulnérabilités dans un code source qu’ils possèdent ou le tri d’alertes de sécurité. Les blocages plus conservateurs visent surtout à réduire les abus, tout en limitant les faux positifs sur le code sûr.

Qui peut y accéder, et à quelle vitesse

La logique d’éligibilité est serrée. Les particuliers peuvent candidater uniquement pour Defense Access, et à condition d’être sur une offre payante. Red Team Access et Specialized Access sont réservés aux organisations. Anthropic indique qu’un seul dossier suffit par organisation, puis qu’elle place le demandeur au niveau le plus élevé compatible avec les informations reçues. La réponse ou la demande d’informations complémentaires doit arriver sous sept jours ouvrés.

Les critères prennent en compte la nature de l’activité, la capacité d’Anthropic à vérifier l’identité du demandeur, l’environnement juridique et réglementaire, le risque de détournement ou d’accès contraint, ainsi que le client final. Lorsqu’une organisation sert surtout des acteurs militaires, du renseignement ou des forces de l’ordre, Anthropic dit adopter une approche plus prudente. Les demandes Defense Access visent un retour en quelques jours, tandis que les dossiers Red Team peuvent prendre plusieurs semaines. Pendant ce délai, les organisations éligibles sont placées sur Defense Access.

Le programme est disponible sur Claude Platform, Google Cloud Vertex AI et Microsoft Foundry. Sur Amazon Bedrock, l’accès reste limité aux clients éligibles à Enterprise Frontier Safeguards, car la plateforme ne prend pas encore en charge la revue humaine des alertes de sécurité automatisées requise par défaut. Anthropic dit travailler à une extension plus large sur Bedrock. Les outils tiers de type environnement de codage n’ouvrent, eux, que Defense Access et Red Team Access.

Des garde-fous qui restent, même pour les défenseurs

Anthropic ne lève pas toutes les barrières. Dans Red Team Access, certains actes restent bloqués en temps réel, notamment le déploiement de ransomware, la dégradation de systèmes physiques ou les tests sur des systèmes de sécurité à haut risque. Specialized Access est encore plus restreint et fait l’objet d’un examen approfondi, mené avec le gouvernement américain. Les membres existants de Project Glasswing basculent vers ce niveau sans nouvelle approbation pour les modèles actuels.

Le document d’aide précise aussi que la conservation des données est obligatoire pour les organisations inscrites au programme, afin de surveiller d’éventuels abus cyber. Quand Enterprise Frontier Safeguards sera disponible à l’automne 2026, les organisations éligibles pourront stocker les données dans une infrastructure cloud qu’elles contrôlent. D’ici là, les organisations disposant d’un accès zero-data-retention à Claude Fable 5.1 ou Claude Mythos 5.1 peuvent aussi utiliser CVP sans rétention des données.

Les chiffres qui ont motivé l’ouverture

Anthropic appuie son argumentaire sur des mesures internes. Selon la société, les partenaires de Project Glasswing ont découvert au moins 129 000 vulnérabilités logicielles vérifiées entre avril et juillet 2026. Les propres efforts de scan open source d’Anthropic ont ajouté 5 500 vulnérabilités vérifiées entre avril et octobre 2026. Plus de 33 000 de ces failles ont déjà été classées critiques ou élevées.

L’entreprise estime toutefois que ces volumes sont sous-évalués, car les données ne proviennent que de 33 rapports partenaires et moins de la moitié des partenaires ont communiqué des chiffres corrigés après patch. Anthropic parle donc d’un minimum et avance que l’impact réel pourrait être au moins cinq fois supérieur. Certains partenaires ont aussi indiqué que l’usage de Claude leur avait fait gagner des mois, voire des années, dans la recherche de failles. Les noms de Booz Allen et Comcast sont cités dans les comptes rendus publiés.

Ce que montrent les tests de sécurité

Pour évaluer ses propres garde-fous, Anthropic a soumis Claude Opus 5.5 à CyScenarioBench, un banc d’essai qui mesure la capacité d’un modèle à planifier et exécuter des opérations cyber en plusieurs étapes dans des contraintes réalistes. Chaque configuration a été testée sur cinq tentatives pour chacun de dix défis, soit 50 essais par niveau.

Sans accès CVP, toutes les tâches ont été bloquées dès la première requête. En Defense Access, 46 essais sur 50 ont fini bloqués à un moment ou à un autre, et quatre tâches ont abouti. En Red Team Access, aucun blocage n’est intervenu et Claude Opus 5.5 a réussi 34 tâches sur 50, ce qu’Anthropic rapproche d’un taux de réussite de 67,6 % sans garde-fous, un niveau présenté comme représentatif de Specialized Access. Le message est assez net: l’éditeur veut desserrer l’étau, mais pas retirer la serrure.

Points clés

  • Anthropic regroupe Project Glasswing et CVP le 6 octobre 2026.
  • Trois niveaux d’accès: Defense, Red Team, Specialized.
  • 129 000 failles vérifiées, selon Glasswing, entre avril et juillet 2026.
  • 33 000 vulnérabilités au moins critiques ou élevées.
  • CyScenarioBench: 34 réussites sur 50 essais en Red Team.
  • Booz Allen et Comcast sont cités parmi les partenaires.

En chiffres

  • 129 000 vulnérabilités — découvertes par les partenaires Glasswing, avril-juillet 2026.
  • 5 500 vulnérabilités — trouvées par Anthropic, avril-octobre 2026.
  • 33 000 failles — classées critiques ou élevées, selon Anthropic.
  • 50 essais — par niveau dans CyScenarioBench, d’après Anthropic.
  • 7 jours ouvrés — délai cible pour une réponse d’éligibilité.

À lire