Anthropic accuse plusieurs sociétés chinoises d’IA de distillation à grande échelle. Alibaba, Dark Side of the Moon et DeepSeek sont accusés de dizaines de millions d'interactions

📅 2026-09-11

Résumé :

Anthropic, une société américaine d'intelligence artificielle, a récemment publié un rapport de renseignement sur les menaces, accusant des institutions telles qu'Alibaba, Moonshot AI, DeepSeek, Xiaomi et plusieurs autres laboratoires chinois d'IA d'extraire leurs capacités de modèles via des appels à grande échelle à Claude et d'utiliser les résultats générés pour former et améliorer leurs propres modèles d'intelligence artificielle. Anthropic appelle ce comportement une « attaque par distillation » non autorisée.

85b45f07f9e00f3c3172f3e3a69b632e.jpg

La soi-disant distillation de modèles fait référence à l'utilisation d'un modèle doté de capacités plus fortes et à plus grande échelle pour générer un grand nombre de réponses, puis à l'utilisation de ces résultats comme données de formation pour former des modèles à moindre coût, à plus petite échelle ou aux capacités plus faibles. Pour les entreprises d’IA, il s’agit d’une voie technique qui peut réduire les coûts de formation et améliorer rapidement les capacités des modèles. Cependant, Anthropic estime que certains des comportements découverts cette fois-ci dépassent le cadre de la distillation normale du modèle et appartiennent à l'extraction organisée et à grande échelle des capacités de leur modèle commercial.

Anthropic a déclaré qu'entre mai et juillet 2026, les opérations liées à Alibaba ont généré plus de 151 millions d'interactions avec Claude, ce qui en fait la plus grande opération de distillation illégale que l'entreprise ait découverte à ce jour. Les opérations concernées ont utilisé plus de 3 500 comptes identifiés par Anthropic comme frauduleux, et le nombre le plus élevé d'interactions par jour était de près de 3 millions.

Anthropic estime que ces comptes sont principalement utilisés pour poser continuellement à Claude un grand nombre de questions et obtenir les réponses du modèle et des processus de raisonnement plus détaillés, puis utiliser ces informations pour améliorer la série de modèles Tongyi Qianwen d'Alibaba.

Pour les développeurs de modèles, le processus d'inférence est particulièrement précieux. Au lieu d'obtenir uniquement la réponse finale, les enregistrements d'inférence détaillés peuvent montrer au formateur comment le modèle a analysé le problème, comment décomposer la tâche et comment parvenir à la conclusion finale, et peuvent donc devenir des données importantes pour la formation de modèles d'inférence avancés.

5949f5ae5197c4dc775d2f06d918999b.png

Anthropic a également nommé Dark Side of the Moon AI, le développeur de Kimi. Le rapport indique qu'entre mai et juillet 2026, les comptes liés à Dark Side of the Moon ont eu plus de 23 millions d'interactions avec Claude.

Ce qui est plus remarquable, c'est qu'Anthropic a accusé Dark Side of the Moon non seulement d'utiliser Claude pour la distillation de modèles, mais également de transmettre de véritables demandes d'utilisateurs de Kimi à Claude pour traitement.

Anthropic a déclaré qu'au cours de l'une des périodes de 10 jours, Dark Side of the Moon a transféré près de 300 000 demandes d'utilisateurs initialement soumises à Kimi à Claude via un réseau de comptes composé de 5 380 comptes, la plupart des demandes étant envoyées à la série de modèles Claude Opus. Anthropic estime que ces comptes sont principalement situés à Singapour et au Japon et sont utilisés pour cacher la source réelle des demandes.

Cela signifie que dans certains cas, les utilisateurs de Kimi pensent qu'ils interagissent avec le propre modèle de Dark Side of the Moon, mais en fait, la demande peut être transmise à Claude d'Anthropic pour traitement. Anthropic a également déclaré que Dark Side of the Moon avait sauvegardé une partie du contenu interactif et extrait les enregistrements de raisonnement de Claude comme données d'entraînement.

Plus inquiétant encore, ces demandes transférées ne sont pas nécessairement du simple contenu de chat ordinaire. Anthropic a déclaré que certaines des demandes contenaient des informations sensibles et que les utilisateurs pouvaient ne pas savoir que leurs données étaient en fait envoyées au modèle d'une autre société d'IA.

f91b5d29494b4f3d17897c0465579de8.jpg

Le rapport cite un cas lié à Kimi. Un utilisateur a demandé à Kimi d'analyser un grand nombre d'images de caméras de surveillance de Chengdu, en Chine, pour déterminer le comportement d'une personne. Selon Anthropic, les données vidéo ont finalement été transférées à Claude pour traitement, et les utilisateurs pensaient à l'origine que les données étaient analysées au sein de Kimi.

Anthropic a également découvert que certains contenus soumis à Kimi par certains utilisateurs impliquaient des informations sensibles telles que les identifiants de connexion de l'entreprise. Dans un cas, un ingénieur a soumis à Kimi les identifiants de connexion de plusieurs entreprises afin d'utiliser Kimi pour aider une entreprise chinoise à développer un logiciel, et les informations pertinentes ont ensuite été transférées à Claude.

Anthropic a déclaré que les utilisateurs ne savent pas clairement que leurs demandes seront transmises au modèle d'Anthropic. Ainsi, en plus d'impliquer des problèmes de distillation du modèle, cette approche peut également créer de sérieux risques en matière de confidentialité et de sécurité des données.

DeepSeek a également été accusé par Anthropic d'adopter une approche similaire. Le rapport indique que DeepSeek a effectué plus de 12 millions d'interactions de distillation liées à Claude sur une période de 14 jours en juillet 2026.

Anthropic pense que DeepSeek a également transmis de véritables demandes d'utilisateurs à Claude, et qu'une partie du contenu de ces demandes contenait des informations sensibles. Les réponses de Claude ont ensuite été utilisées pour former et améliorer les propres modèles de DeepSeek.

En plus d'Alibaba, Dark Side of the Moon et DeepSeek, Anthropic a également cité des sociétés chinoises d'IA telles que Zhipu et Xiaomi. Selon le rapport, Xiaomi a enregistré des discussions entre les utilisateurs et son modèle MiMo et a transmis ces conversations à Claude pour générer des données pour la formation du modèle.

Anthropic a déclaré qu'au cours de la période couverte par son rapport, sept laboratoires chinois d'IA ont mis en œuvre des activités de distillation modèles ciblant Claude. Toutes les activités associées n'utilisent pas exactement la même méthode, mais la caractéristique commune est qu'elles tentent d'obtenir une grande quantité de résultats de Claude, d'apprendre les capacités de son modèle et d'utiliser ces informations pour la formation de leurs propres systèmes d'IA.

Anthropic estime que ces activités sont devenues de plus en plus organisées et à grande échelle. Contrairement aux développeurs ordinaires qui appellent occasionnellement d'autres modèles d'IA pour les tester, ces opérations utilisent un grand nombre de comptes, d'agents et de plates-formes intermédiaires pour cacher leur véritable identité et générer en permanence des interactions de modèles à l'échelle industrielle.

dd9e04472e39d531b91dc1c42fa0cad6.jpg

Parmi elles, les activités liées à Alibaba ont attiré une attention particulière. Plus de 151 millions d’interactions ont fait de l’opération non pas un simple test expérimental, mais une opération d’acquisition de données à grande échelle qui a duré plusieurs mois. Anthropic estime que ces données sont principalement utilisées pour aider à former et à améliorer le modèle Tongyi Qianwen d'Alibaba.

Pour Dark Side of the Moon et DeepSeek, le problème est plus compliqué, car Anthropic les accuse non seulement d'obtenir des données d'entraînement de Claude, mais également de transmettre leurs propres demandes d'utilisateurs à des modèles concurrents. Cela signifie que le contenu soumis par les utilisateurs à une société d’IA peut entrer dans le système d’une autre société d’IA sans notification explicite.

Anthropic a déclaré avoir pris des mesures pour mettre fin à ces activités, notamment en interdisant les comptes concernés, en renforçant la vérification de l'identité et en limitant davantage la capacité de Claude à produire des raisonnements détaillés. Étant donné que les enregistrements d'inférence détaillés sont très précieux pour la distillation des modèles, la réduction de la sortie de ce contenu peut réduire l'efficacité des concurrents reproduisant les capacités de Claude via un grand nombre de requêtes automatisées.

Anthropic a également déclaré que la société renforcerait les mesures de vérification d'identité pour les utilisateurs de pays ou de régions où Claude ne fournit actuellement pas de services officiels, comme la Chine, la Russie et l'Iran, mais qui sont soupçonnés de tenter de contourner les restrictions et d'accéder à Claude.

28d3b33c4fc787d733f087fd8ef8efe8.jpg8707bed652c494aab56984bea46dd9e8.jpg4c47000037ad171df342392102579798.jpgcc63593d60bee286809b4685c3eb858f.jpg

Ce rapport n’est pas la première fois qu’Anthropic accuse publiquement les sociétés chinoises d’IA de distillation de modèles. En juin de cette année, Sarah Heck, directrice de la politique d'Anthropic, a écrit aux membres du Congrès américain, déclarant qu'Alibaba avait eu environ 28,8 millions d'interactions avec Claude entre le 22 avril et le 5 juin et pensait que ces interactions étaient utilisées pour la distillation de modèles non autorisée.

Ce dernier rapport montre qu'Anthropic estime que l'ampleur des activités connexes va encore s'étendre à l'avenir. Alibaba à lui seul a enregistré plus de 151 millions d'interactions entre mai et juillet, bien plus que les chiffres précédemment divulgués.

Dans le même temps, cet incident s'est produit dans un contexte de concurrence de plus en plus féroce en matière d'IA entre la Chine et les États-Unis. Ces dernières années, les entreprises chinoises d’IA ont rapidement amélioré leurs capacités de modélisation avec des coûts de formation et d’inférence relativement faibles. Des produits tels que DeepSeek, Kimi et Tongyi Qianwen sont devenus des acteurs importants dans l’industrie mondiale de l’IA. Les sociétés américaines d’IA proposent des modèles de base avancés, notamment les séries Claude et GPT.

4e6306117e36bb70e6d4a37a38b66fce.jpg

La distillation sur modèle en elle-même n'est pas une technique illégale ou déraisonnable. Les développeurs d'IA peuvent utiliser les données générées par le modèle d'enseignant pour former leurs propres modèles avec autorisation. Cependant, Anthropic estime que l'opération en question pose un problème sérieux car les sociétés concernées sont accusées d'avoir systématiquement obtenu les capacités de Claude sans l'autorisation d'Anthropic à travers un grand nombre de faux comptes, de plateformes d'agence et de mécanismes cachés de transfert de données.

Plus important encore, Anthropic estime que certaines actions ont touché à des problèmes de sécurité des données des utilisateurs. Les utilisateurs qui utilisent normalement les services d’IA pensent généralement que les données qu’ils soumettent à des plateformes telles que Kimi et DeepSeek seront traitées conformément aux politiques de confidentialité de ces plateformes. Si la plateforme transmet effectivement ces demandes à un modèle tiers, les utilisateurs risquent de ne pas savoir que leurs données sont entrées dans le système d'une autre entreprise.

d3b954205872a70115454046845c4f45.jpg

5dd32c210036575dc7c13849d00d5e94.jpg

040ab041c9ba0953d89dfae422eb8039.jpg

040ab041c9ba0953d89dfae422eb8039.jpg

Au moment de la publication du rapport, Alibaba, Dark Side of the Moon, DeepSeek, Xiaomi et Anthropic n'avaient pas immédiatement répondu aux demandes de commentaires. Le ministère chinois des Affaires étrangères a déclaré qu'il n'était pas au courant du rapport publié par Anthropic et a réitéré que le gouvernement chinois estime que l'intelligence artificielle devrait être utilisée au profit de l'humanité et qu'il s'oppose à la déformation des faits et à la diffamation de la Chine.

1329f51b35456fa2a3c2866826ead451.jpg

efac400f942f00f62ef8acb28178b3bf.jpg

L'incident révélé par Anthropic a également refait surface la controverse de longue date sur la distillation des modèles dans l'industrie de l'IA. Pour les entreprises disposant de modèles de base avancés, comment empêcher les concurrents d'acquérir des capacités de modèle grâce à l'automatisation et aux appels à grande échelle est devenu un problème important dans les domaines des affaires et de la sécurité. Pour les sociétés d’applications d’IA, la manière de gérer les données des utilisateurs et la question de savoir si les utilisateurs doivent être clairement informés que les demandes sont transmises à des modèles tiers pourraient également faire l’objet d’une attention réglementaire future.

Du point de vue de la concurrence industrielle, les chiffres publiés par Anthropic sont particulièrement remarquables. Plus de 151 millions d’interactions liées à Alibaba, plus de 23 millions d’interactions liées à la face cachée de la Lune et plus de 12 millions d’interactions liées à DeepSeek montrent que la concurrence entre les modèles d’IA avancés ne concerne plus uniquement les algorithmes et les puces au sens traditionnel du terme, mais s’étend à des domaines tels que les données d’entraînement, l’acquisition de capacités de modèles et la distillation de modèles.

Alors que l'écart de capacités entre les différents modèles d'IA continue de se réduire, la manière de tracer une ligne claire entre l'utilisation légale de la technologie publique, la distillation normale de modèles et la duplication non autorisée de capacités à grande échelle deviendra un problème de plus en plus difficile auquel l'industrie mondiale de l'IA devra faire face à l'avenir.

Tags associés

Articles similaires

Commentaires

0/500
Captcha (click to refresh)
Aucun commentaire