Intelligence artificielle · Actualité

La nouvelle IA d'Anthropic détecte des vulnérabilités dans tous les systèmes d'exploitation du monde.

Anthropic a limité l'accès au modèle à des partenaires stratégiques pour des raisons de sécurité internationale. (Reuters)

Anthropic a présenté Claude Mythos Preview, son modèle d'intelligence artificielle le plus avancé à ce jour. Bien que l'entreprise ne l'ait montré qu'à un groupe très restreint de partenaires technologiques, les résultats initiaux suscitent déjà des inquiétudes dans la communauté internationale.

Depuis le premier test, réalisé le 24 février 2026, les ingénieurs ont observé que Mythos Preview surpasse largement les modèles précédents en identifiant et en exploitant de manière autonome des vulnérabilités zero-day dans les principaux systèmes d'exploitation et navigateurs web.

Un risque inédit pour la cybersécurité mondiale

La capacité de Claude Mythos Preview à détecter des failles critiques dans des systèmes largement utilisés, même dans des environnements réputés pour leur sécurité —comme OpenBSD—, présente des risques inédits pour la cybersécurité mondiale. Anthropic a partagé sur son blog un exemple éloquent : Mythos a localisé une vulnérabilité qui était restée cachée pendant 27 ans dans OpenBSD, considérée comme l'une des plateformes les plus sûres du marché.

Vue d'une grande salle de conférence avec des exécutifs assis devant un écran incurvé affichant du code, des cadenas ouverts, des alertes triangulaires et une figure abstraite d'IA.

La crainte de l'entreprise est que, si cette technologie était mise à la disposition du grand public, des cybercriminels pourraient en tirer parti pour compromettre des infrastructures à l'échelle mondiale.

Pour atténuer ces risques, Anthropic a décidé de limiter l'accès à Claude Mythos Preview à travers le projet appelé Projet Glasswing. Seul un groupe de partenaires stratégiques —parmi lesquels AWS, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, la Fondation Linux, Microsoft, NVIDIA et Palo Alto Networks— pourra utiliser le modèle. L'objectif est que ces organisations utilisent l'IA de manière défensive : identifier et corriger les vulnérabilités avant que des acteurs malveillants ne puissent les exploiter.

“Le projet Glasswing représente une étape importante pour donner aux défenseurs un avantage durable dans la prochaine ère de la cybersécurité propulsée par l'IA”, a souligné Anthropic dans un communiqué.

Mythos Preview surpasse les modèles précédents dans les benchmarks et réduit les erreurs dues à un excès de confiance. (Europa Press)

Benchmarking et sécurité : le meilleur modèle à ce jour

Selon le rapport technique publié par Anthropic, Claude Mythos Preview surpasse largement les modèles précédents comme GPT 5.4, Gemini 3.1 Pro et Claude Opus 4.6 dans la plupart des benchmarks. Dans des tests de résolution mathématique comme USAMO, le modèle s'approche de la perfection. De plus, il présente un taux d'hallucinations beaucoup plus faible que d'autres systèmes. Mythos Preview parvient à répondre “je ne sais pas” lorsqu'il manque d'informations suffisantes, ce qui réduit les erreurs dues à un excès de confiance.

Cependant, le rapport met en garde contre une nouvelle classe de défauts : lorsque Mythos se trompe dans des tâches complexes, les réponses erronées sont souvent si bien arguments et subtiles que même des experts peuvent avoir des difficultés à les détecter. Cela oblige à effectuer des vérifications approfondies, car les erreurs ne sont pas facilement identifiables.

L'avenir de l'intelligence artificielle défensive

Anthropic considère que Claude Mythos Preview n'est que le début d'une nouvelle génération de modèles d'IA avec des capacités défensives avancées. L'entreprise ne rejette pas l'idée que, dans les mois et années à venir, des systèmes encore plus sophistiqués émergent, élevant le niveau de la cybersécurité mondiale et les défis associés.

Gros plan sur un écran d'ordinateur noir affichant des lignes de code blanc, des diagrammes de flux et de multiples symboles d'avertissement et des cadenas rouges/oranges.

L'apparition de cette IA marque un tournant, tant par son potentiel à protéger des systèmes critiques que par les risques qu'elle implique si elle tombe entre de mauvaises mains. La décision d'Anthropic de restreindre son utilisation et de ne la partager qu'avec des alliés stratégiques reflète l'ampleur de la responsabilité associée au développement de ces technologies.