Intelligence artificielle · Actualité

Anthropic accuse des entreprises chinoises d'utiliser Claude en secret "pour imiter ses capacités dans les modèles d'IA"

Anthropic a identifié et désactivé une série de campagnes de distillation illicite au cours desquelles au moins sept laboratoires d'intelligence artificielle basés en Chine ont extrait secrètement les capacités de son modèle Claude pour les répliquer dans leurs propres systèmes, selon le rapport d'intelligence sur les menaces de l'entreprise.

Parmi les entités visées figurent Alibaba, Moonshot AI, DeepSeek, Zhipu (connue en dehors de la Chine sous le nom de Z.ai), Xiaomi, SenseTime et MiniMax.

Le document distingue la distillation légitime — une méthode d'entraînement courante dans l'industrie, où un modèle « maître » plus avancé génère des réponses servant ensuite à entraîner un modèle « élève » plus petit — de ce que l'entreprise définit comme distillation illicite : « une campagne couverte à l'échelle industrielle pour extraire les capacités d'un modèle et les répliquer dans un autre sans autorisation ».

Alibaba a mené la plus grande attaque mesurée par l'entreprise

Selon Anthropic, des opérateurs liés à Alibaba ont exécuté la campagne de distillation la plus importante jamais enregistrée par l'entreprise, ciblant les modèles de raisonnement Opus 4.6 et 4.7.

Le mécanisme consistait à injecter une instruction fixe dans chaque requête qui forçait Claude à exposer sa chaîne de raisonnement interne avant de fournir la réponse finale. Ces enregistrements étaient ensuite convertis en données pour le réglage fin supervisé des modèles Qwen 3.5, 3.6 et 3.7 d'Alibaba.

L'opération a atteint un pic de près de trois millions d'échanges quotidiens, lancés depuis plus de 3 500 comptes frauduleux. Au total, Anthropic a attribué à Alibaba plus de 151 millions d'échanges entre mai et juillet 2026. L'entreprise a ajouté qu'en plus de la distillation, Alibaba a utilisé Claude pour développer son infrastructure interne d'entraînement et faire progresser la recherche sur l'architecture des modèles et les environnements d'apprentissage par renforcement.

Moonshot et DeepSeek ont détourné les requêtes des utilisateurs sans les informer

Le rapport détaille que Moonshot AI, responsable de la famille de modèles Kimi, a redirigé secrètement les requêtes de ses propres clients vers Claude et leur a affiché les réponses générées par ce dernier sans que les utilisateurs ne sachent qu'ils n'interagissaient pas avec Kimi. Sur une période de dix jours, Moonshot a transféré environ 300 000 requêtes, la plupart canalisées vers le modèle Opus, via un réseau de 5 380 comptes frauduleux situés principalement à Singapour et au Japon.

Anthropic a affirmé que Moonshot a réussi à extraire les traces de raisonnement de Claude par une attaque de « répétition entre sessions », une technique qui contourne les protections conçues précisément pour empêcher ce type d'extraction. L'entreprise a attribué à Moonshot plus de 23 millions d'échanges entre mai et juillet.

DeepSeek a utilisé une méthode similaire. Selon le rapport, l'entreprise a détourné les demandes des utilisateurs qui tentaient d'utiliser ses modèles via des outils tiers, tels que Claude Code ou le SDK Claude Agent, en les identifiant par des chaînes de texte spécifiques et en les redirigeant vers Opus. Anthropic a estimé à plus de 12,1 millions les échanges attribuables à DeepSeek en seulement quatorze jours de juillet.

Zhipu, Xiaomi et d'autres entreprises complètent la liste des mises en cause

Zhipu, qui opère hors de Chine sous la marque Z.ai, a fait tourner 273 comptes frauduleux pour extraire puis « nettoyer » les traces de raisonnement de Claude Opus 4.8 destinées à ses modèles GLM. Anthropic a comptabilisé 770 609 échanges sur une période de dix jours via ce mécanisme et plus de 3,4 millions d'échanges totaux attribués à la firme entre juin et juillet.

Le rapport ajoute que Zhipu a tenté initialement d'attaquer les capacités cybernétiques du modèle Fable, le plus avancé d'Anthropic, mais a abandonné l'essai après avoir constaté que ses défenses étaient plus difficiles à contourner, et a déplacé ses efforts vers Opus 4.6.

Xiaomi, pour sa part, a reproduit des conversations et des sessions de programmation de son propre modèle MiMo via Claude afin de générer des données d'entraînement, avec plus de 400 000 demandes envoyées par le biais de 1 500 comptes. Anthropic a soutenu que cette opération coïncidait avec la fin d'une période d'essai gratuit de MiMo-V2-Pro, ce qui suggère que l'entreprise a profité de l'augmentation de l'utilisation internationale pour extraire les capacités de Claude.

L'informatif mentionne également SenseTime, qui aurait acquis des transcriptions de conversations avec Claude auprès de fournisseurs externes de données, et MiniMax, qui selon Anthropic a créé un réseau de proxy par le biais d'une entreprise écran sans liens visibles avec sa maison-mère, offerte exclusivement pour accéder aux modèles d'Anthropic et OpenAI, sans inclure ses propres systèmes.

Des données sensibles des utilisateurs ont été exposées lors du processus

Anthropic a averti que, dans plusieurs de ces cas, les conversations détournées vers Claude contenaient des informations sensibles des utilisateurs finaux, y compris des noms, des adresses e-mail et des données corporatives des clients de Moonshot, DeepSeek et Xiaomi dans au moins une douzaine de langues, beaucoup provenant de services de routage de modèles utilisés habituellement par les utilisateurs des États-Unis et d'Europe. La société a indiqué qu'elle n'a pas connaissance que ces clients aient été notifiés du fait que leurs demandes étaient redirigées vers un tiers.

L'entreprise a indiqué qu'elle a répondu à ces épisodes en bloquant les comptes concernés, en renforçant ses classificateurs de détection et en intégrant de nouvelles sauvegardes techniques, dont un système qui résume le raisonnement interne de Claude avant de l'afficher et un mécanisme empêchant de modifier le contexte préalable au raisonnement du modèle dans les nouveaux comptes de l'API.