kasinv - stock.adobe.com

Cybersécurité et IA : Anthropic étend son Cyber Verification Program

Anthropic ouvre un peu plus les vannes de son Cyber Verification Program. Les spécialistes de la cybersécurité troquent une surveillance accrue de leurs activités contre l’accès aux grands modèles de langage Claude sans leurs filtres. Un moyen d’améliorer le niveau de défense général contre les cyberattaquants, assure le fournisseur.

En sus du lancement de Claude Haiku 5.5, Anthropic étend son programme de vérification cyber (Cyber Verification Program ou CVP). Plutôt, il le fusionne avec le très sélectif projet Glasswing.

Cette initiative permet à des éditeurs, des chercheurs en cybersécurité, des entreprises, des organisations publiques et des gouvernements d’accéder aux modèles les plus performants au nom de leur cyberprotection.

Dans ce cadre, les modèles d’IA de raisonnement sont dépourvus de leurs filtres. En effet, parce que les attaquants sont tentés d’utiliser ses grands modèles de langage pour créer des maliciels et rançongiciels, Anthropic bloque la plupart des prompts qui ont un lien avec des tâches de cybersécurité.

Le projet Glasswing et le Cyber Verification Program permettaient déjà de montrer patte blanche pour accéder aux modèles les plus puissants du fournisseur sans leur filtre (ou presque). Or ce cordon de protection était sans doute trop resserré. Par exemple, lors de l’incident de cybersécurité provoqué par un test d’OpenAI, Hugging Face avait pu constater l’impossibilité d’analyser la menace avec les modèles d’Anthropic disponibles publiquement.

« Lorsque nous avons lancé la première version du CVP, nous savions que notre stratégie n’était pas parfaite, mais il s’agissait d’une première étape importante alors que nous cherchions un meilleur moyen de soutenir cette communauté en toute sécurité », affirme Curt Barnard, membre de l’équipe IA et sécurité chez Anthropic.

Trois niveaux d’accès pour les équipes cyber et les red teams

Dont acte. L’extension du Cyber Verification Program se matérialise par la création de trois accès différents : Defense, Red Team et Specialized.

Le premier se destine aux équipes de cybersécurité, aux chercheurs, aux éditeurs ou encore aux mainteneurs de projets open source. Selon Anthopic, tous les utilisateurs peuvent aujourd’hui réviser du code, faire évoluer leur modèle de menaces, trouver et corriger des failles connues et trier des alertes de cybersécurité avec les modèles Claude publiquement disponibles. En clair, il n’est pas nécessaire d’utiliser des modèles chinois, induit Anthropic.

En revanche, l’analyse de malware, la validation d’exploitation, le tri de vulnérabilités par importance peuvent être bloqués. L’accès défense « arrache » ces filtres.

L’accès Red Team se destine principalement aux sociétés de pentesting. Là, elles peuvent se servir des LLM d’Anthropic pour émuler des attaques, mener les tests de pénétration eux-mêmes, développer des outils de recherche de failles et de validation de leur exploitation.

Enfin, l’accès spécialisé est réservé aux prestataires de mainteneurs d’infrastructures critiques (réseaux électriques, télécom, systèmes aéroportuaires, systèmes financiers, SI militaires, etc.), les gouvernements (américains et alliés), les banques et les entreprises régulées concernés ainsi qu’un petit nombre de sociétés de cybersécurité triées sur le volet. Il permet de mener des pentests sur des infrastructures critiques ainsi que d’effectuer des recherches sur les techniques d’exploitation les plus sévères. Tous les membres existants de Glasswing y ont le droit. Les prochains utilisateurs seront triés sur le volet et le gouvernement américain validera les candidats.

Les chercheurs indépendants peuvent seulement accéder au tier Defense. Pour les entreprises, une seule candidature par formulaire suffit. Dans les deux cas, le postulant devra présenter son entreprise et les personnes qui utiliseront les LLM.

« Dans le cadre du processus de candidature, nous vérifierons l’éligibilité de tous les candidats et leur demanderons de fournir la preuve qu’ils disposent des contrôles de sécurité requis pour le niveau d’accès concerné », ajoute Anthropic.

« Cela exige une vérification d’identité et une courte demande de réponses sur vos cas d’usage avec un minimum de preuves à l’appui », témoigne Justin Scott, fondateur et CEO de la société Outpost Business Solutions, sur LinkedIn. « J’ai été approuvé quelques heures après avoir postulé récemment et je remarque déjà une différence ».

Cela concerne Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 et les futurs LLM du fournisseur.

À noter que les usagers de l’accès Defense ont jusqu’au 15 décembre pour ne plus utiliser directement les clés API et passer par une authentification multifacteur, par exemple à travers la fonctionnalité Workload Identity Federation.

« La conservation des données est obligatoire pour les organisations inscrites au programme afin de nous permettre de surveiller les abus », souligne le fournisseur.  

« Dès qu’Enterprise Frontier Safeguards (EFS) – une nouvelle solution alliant la confidentialité offerte par la non-conservation des données à des mesures de protection robustes – sera disponible à la fin de l’automne, les organisations éligibles pourront stocker leurs données dans une infrastructure cloud qu’elles contrôlent », mentionne-t-il.  

Pour l’heure, seules les entreprises ayant accès à Claude Fable 5.1 et Mythos 5.1 avec une politique de non-conversation des données peuvent conserver cette option avec le programme CVP.

Convaincre davantage de professionnels de la cyber

Hormis un effort administratif et une surveillance accrue, le programme CVP n’entraîne pas de facturation supplémentaire. Anthropic applique sa grille tarifaire publique. Les entreprises peuvent y accéder via la plateforme Claude, Google Cloud Vertex AI, Microsoft Foundry et celles intéressées par l’option EFS devront se tourner vers Amazon Bedrock.

« Dans le cadre de ce programme, nos partenaires ont identifié au moins 129 000 vulnérabilités logicielles vérifiées entre avril et juillet 2026 », vante Anthropic. « De notre côté, grâce à nos propres efforts d’analyse des logiciels open source, nous avons découvert 5 500 vulnérabilités logicielles vérifiées supplémentaires entre avril et octobre 2026 ».

Et d’assurer que l’extension du programme vise à équiper un plus grand nombre de cyberdéfenseurs.

Anthropic n’est pas le seul fournisseur de LLM à proposer un programme consacré à la cybersécurité. Google mise sur Fairwind, tandis qu’OpenAI dispose de Daybreak. En Europe, Mistral semble chercher à mettre sur pied une initiative similaire.  

Il n’est pas évident que cela suffise à empêcher les entreprises et les indépendants de se tourner vers les modèles open weight chinois. Ou Français. GLM-5.2 et GLM 5.3 et bientôt Mistral Large 4 offrent des capacités équivalentes à Mythos à moindre prix et peuvent être hébergés sur site. Cela réclame a minima un cluster de huit GPU Nvidia B300 ou deux clusters H100 ou H200, ce qui n’est pas à la portée de toutes les bourses. Il faut donc bien choisir l’hébergeur des modèles chinois. Mistral AI a fait le choix d’héberger GLM 5.3.

« Il est évident que le programme CVP n’est pas bon marché », consent Dennis Xu, analyste Xu auprès de TechTarget. « On paie plus cher pour une meilleure défense et de meilleurs tests offensifs », assure-t-il, en affirmant que les LLM open weight sont encore en deçà de ceux d’Anthropic et d’OpenAI.

Reste la question de la protection des accès. Les systèmes de vérification d’identité et les mécanismes d’authentification à facteurs multiples sont aussi des cibles pour les attaquants.

Pour approfondir sur IA appliquée à la cybersécurité