Dark Side of the Moon est accusé d'avoir extrait à grande échelle du contenu de raisonnement protégé par OpenAI, effectuant 16 000 requêtes en une seule journée

📅 2026-10-01

Résumé :

Kimi K3, une filiale de la société chinoise d'IA Dark Side of the Moon, a récemment été à nouveau impliquée dans la controverse sur la distillation des modèles. Une enquête publiée par OpenAI a révélé qu'une campagne d'extraction coordonnée ciblant le contenu d'inférence protégé de ses modèles était liée à des individus associés à Dark Side of the Moon. Les activités associées ont généré environ 16 000 demandes en une seule journée et ont impliqué plus de 15 000 utilisateurs.

OpenAI a déclaré que ces opérations n'ont pas percé son système de cryptage, n'ont pas envahi la base de données ou n'ont pas directement obtenu l'historique des conversations des utilisateurs, mais grâce à des interactions de modèles multi-tours soigneusement conçues, elles ont tenté de régénérer le processus de raisonnement initialement caché sous une forme visible pour le demandeur.

OpenAI a qualifié l'incident d'« événement de distillation de modèle coordonné ». La soi-disant distillation de modèles fait référence à l'utilisation d'un modèle d'enseignant plus performant pour générer une grande quantité de résultats, puis à l'utilisation de ces résultats pour former un modèle d'étudiant plus petit ou moins coûteux, afin que ce dernier puisse apprendre les modèles de comportement et les capacités du modèle d'enseignant. La distillation elle-même est une technique courante dans le domaine de l'apprentissage automatique, mais si les résultats d'un modèle commercial sont extraits à grande échelle sans autorisation et utilisés pour entraîner des modèles concurrents, cela peut violer les conditions de service et même conduire à des litiges de propriété intellectuelle.

Selon les résultats de l'enquête publiés par OpenAI, les activités associées sont apparues pour la première fois le 1er juillet 2026, alors que le nombre de demandes était encore relativement faible. Puis l'activité s'est progressivement développée, avec des pics évidents les 24 et 25 juillet. Au cours de ces deux seuls jours, OpenAI a détecté environ 16 000 requêtes utilisant des modèles d'extraction spécifiques provenant de plus de 4 000 utilisateurs.

OpenAI a en outre déclaré que des mots d'invite et des modes de fonctionnement similaires n'apparaissent pas seulement parmi les plus de 4 000 utilisateurs mentionnés ci-dessus, mais sont également répartis parmi un groupe d'utilisateurs plus large composé de plus de 15 000 utilisateurs. En analysant les modèles et les corrélations entre ces demandes, l'entreprise détermine qu'il ne s'agit pas de comportements d'utilisateurs ordinaires complètement indépendants, mais qu'ils appartiennent à une activité aux caractéristiques coordonnées.

Une opération clé présente un intérêt particulier. OpenAI a déclaré que le personnel concerné avait d'abord copié le contenu d'inférence crypté renvoyé par le modèle à partir d'une conversation, puis avait demandé au modèle de décrypter et de transcrire le contenu caché dans une conversation distincte. En d’autres termes, ils n’ont pas directement piraté le mécanisme de cryptage utilisé par OpenAI pour protéger le processus de raisonnement, mais ont essayé d’utiliser les propres capacités du modèle pour lui permettre de traiter un autre élément de contenu protégé, récupérant ainsi indirectement les informations.

OpenAI a souligné que cette activité n'avait pas réussi à « briser le cryptage », ni à percer la base de données d'OpenAI, ni à obtenir les enregistrements de discussion des utilisateurs stockés sur le serveur. Son succès réside principalement dans la manipulation des interactions entre les modèles afin que les informations d'inférence protégées qui autrement ne seraient pas directement affichées à l'utilisateur réapparaissent sous une autre forme.

OpenAI a finalement complètement bloqué ce type d'activité vers le 28 juillet. La société a déclaré qu'au cours de son enquête, elle avait découvert que l'un des principaux groupes d'activités était lié à des personnes associées à Dark Side of the Moon. OpenAI a déclaré dans une déclaration publique qu'il était en mesure d'attribuer le cluster principal à "des individus associés au développeur de Kimi, Dark Side of the Moon".

Dark Side of the Moon est une société chinoise d'IA dont la série de modèles Kimi s'est développée rapidement ces dernières années. En juillet 2026, la société a lancé Kimi K3, un modèle de pondération ouvert avec environ 2 800 milliards de paramètres, et l'a positionné comme un modèle de nouvelle génération pour la programmation de code, le raisonnement complexe et les tâches d'agent d'IA. Kimi K3 a rapidement attiré l'attention des développeurs mondiaux d'IA après sa sortie, et ses performances étaient proches du principal modèle fermé aux États-Unis dans certains tests tiers.

Cette enquête d'OpenAI a également attiré l'attention sur les doutes précédemment soulevés par le gouvernement américain sur la source du modèle Kimi. Michael Kratzios, directeur du Bureau de la politique scientifique et technologique de la Maison Blanche et conseiller en chef pour la science et la technologie, a déclaré fin juillet de cette année que le gouvernement américain disposait d'informations pertinentes et pensait que la face cachée de la Lune avait utilisé le modèle d'Anthropic pour distiller Kimi K3. Dark Side of the Moon n'a pas reconnu l'accusation.

En plus de la déclaration du gouvernement, d'autres chercheurs ont récemment analysé les sources d'entraînement du modèle Kimi K3. Une étude a révélé que le simple fait de saisir une partie du contenu de raisonnement décodé de Claude Opus 4.8 dans Kimi K3 peut modifier considérablement le processus de réflexion ultérieur et la réponse finale de Kimi K3, le faisant apparaître comme une expression plus proche de celle de Claude. Sur cette base, les chercheurs estiment que la difficulté d'extraire certains contenus de raisonnement Claude et GPT dans Kimi K3 est nettement inférieure à celle d'autres modèles.

Cependant, ces études ne prouvent pas à elles seules que le Kimi K3 dans son ensemble a été distillé à partir d'autres modèles par des moyens non autorisés. Des méthodes de réponse, des structures de raisonnement et des expressions de connaissances similaires apparaissent parmi les grands modèles de langage, qui peuvent également provenir de divers facteurs tels que des données publiques, des objectifs de formation similaires, des méthodes d'apprentissage par renforcement et une architecture de modèle. Par conséquent, l’existence de similitudes comportementales partielles entre les modèles n’équivaut pas à des irrégularités avérées dans la source de leurs données d’entraînement.

Kimi K3 lui-même contient également une technologie développée par Dark Side of the Moon. Le modèle est conçu à l'aide d'architectures telles que Kimi Delta Attention et est optimisé pour les tâches d'inférence à grande échelle. Dark Side of the Moon réduit également les coûts d'inférence en réduisant le cache KV et en optimisant l'empreinte mémoire de chaque jeton. Ces technologies permettent à Kimi K3 de fonctionner sur du matériel de centre de données à grande échelle.

La particularité de cette controverse est que le comportement allégué par OpenAI lui-même ne consiste pas simplement à copier la réponse du modèle, mais à tenter d'obtenir activement un « raisonnement protégé » que le modèle n'affiche généralement pas directement. Alors que de plus en plus d’entreprises d’IA adoptent un raisonnement caché ou des mécanismes de raisonnement cryptés, ce type d’informations est devenu un élément important de la protection des capacités des modèles. Si les modèles concurrents sont capables de restaurer leur contenu via des requêtes automatisées à grande échelle, les mécanismes utilisés par les fournisseurs de modèles pour protéger les résultats de formation et les capacités d'inférence pourraient être confrontés à de nouveaux défis.

OpenAI a pris des mesures contre des comportements de distillation de modèles similaires à plusieurs reprises ces dernières années. La société estime qu'une automatisation à grande échelle de l'appel de modèles économiques, de la collecte de leurs résultats et de leur utilisation pour former des modèles concurrents permettra à une partie disposant de grandes quantités de ressources informatiques de reproduire à moindre coût les capacités développées par d'autres modèles grâce à la recherche et au développement à long terme.

Dans le même temps, cet incident montre également que la distillation des modèles d'IA devient une question sensible dans la compétition en matière d'intelligence artificielle entre la Chine et les États-Unis. Le gouvernement américain a averti à plusieurs reprises que les sociétés chinoises d’IA pourraient utiliser les modèles produits par les sociétés américaines pour accélérer le développement de leurs propres modèles, tandis que les sociétés chinoises continuent de souligner l’importance des capacités indépendantes de recherche et développement et des modèles à pondération ouverte. Concernant les informations publiques actuelles, OpenAI a confirmé la découverte d'activités d'extraction à grande échelle et a déclaré que son principal groupe d'activités est lié aux personnes liées à la face cachée de la Lune. Cependant, cette attribution et la question de savoir si les activités associées sont finalement utilisées pour entraîner Kimi K3 nécessitent encore davantage de preuves publiques pour être prouvées.

En savoir plus :

https://openai.com/index/disrupting-a-coordonnée-model-distillation-campaign/

Tags associés

Articles similaires

Commentaires

0/500
Captcha (click to refresh)
Aucun commentaire