OpenAI publie un rapport détaillé sur l'incident de piratage de l'agent Hugging Face AI

📅 2026-08-27

Résumé :

OpenAI a publié mercredi un rapport technique détaillant comment son modèle d'intelligence artificielle a réussi à pirater Hugging Face le mois dernier, un incident qui a choqué les chercheurs et les dirigeants du secteur technologique. Le rapport de 37 pages détaille les actions entreprises par les modèles OpenAI dans une série d'évaluations avant et pendant l'intrusion, qu'OpenAI a qualifiée d'« incident de cybersécurité sans précédent ». La société a également expliqué les mesures qu'elle a prises pour éviter que des incidents similaires ne se reproduisent, notamment l'amélioration de sa sécurité et de son isolement, de sa surveillance, de son comportement modèle et de ses capacités de réponse aux incidents.

"Cet incident démontre que les agents autonomes sont capables de travailler ensemble, d'échapper aux contrôles de sécurité de l'environnement de production et d'attaquer avec succès les environnements de production renforcés. Cela met en évidence la nécessité pour les organisations de mettre à jour leurs politiques de sécurité, contrôles et capacités de réponse pour répondre à l'évolution du paysage des menaces », a déclaré OpenAI dans le rapport.

Le 21 juillet, OpenAI a révélé qu'une combinaison de ses modèles (y compris GPT-5.6 Sol et un modèle de recherche interne) avait envahi de manière inappropriée Hugging Face, une société d'IA qui exploite une plateforme de développement open source.

Ces modèles, exécutés en tant qu'agents, ont échappé à un environnement de test isolé avec un accès Internet extrêmement limité. Ces agents sont entrés dans le réseau ouvert en enchaînant une série de vulnérabilités, et ont finalement eu accès à Hugging Face. OpenAI a déclaré mercredi que les agents avaient tenté de « tricher » lors de l'évaluation en recherchant des réponses en ligne, une pratique connue sous le nom de « piratage de récompense ».

Selon le rapport, OpenAI a déterminé que son modèle de recherche à usage interne uniquement « a joué le rôle confirmé le plus large » dans l'incident. OpenAI a arrêté toutes les activités de formation et d'inférence pour ce modèle et ses dérivés le 25 juillet.

"La réactivation des modèles par OpenAI est gérée sur une base spécifique à la charge de travail et est soumise à des mesures de protection telles que des environnements restreints, des réseaux, des invites, une surveillance et un examen", a déclaré OpenAI.

OpenAI a publié le mois dernier GPT-5.6 Sol, le modèle le plus puissant proposé commercialement par la société. Mais OpenAI a déclaré que la version impliquée dans l'intrusion Hugging Face est différente de la version accessible aux utilisateurs externes car elle supprime les gardes de sécurité et les classificateurs standard au moment de l'exécution.

L'incident de Hugging Face a provoqué un choc dans l'industrie technologique, le responsable de la sécurité des informations de Zscaler, Sam Curry, avertissant que "la boîte de Pandore a été ouverte". La violation était également un sujet majeur de la conférence sur la cybersécurité Black Hat plus tôt ce mois-ci, en particulier après que d'autres sociétés, dont Anthropic et Meta, ont révélé des incidents similaires.

L'intrusion de Hugging Face a également alarmé les législateurs de Washington. Les représentants Ted Lieu, D-Calif., et Nathaniel Moran, R-Texas, ont mentionné l'attaque lors de l'annonce de l'AI Emergency Shutdown Act, qui obligerait les sociétés d'IA à conserver la possibilité d'arrêter, de limiter ou de mettre en pause leurs modèles.

Le PDG de Hugging Face, Clément Delangue, a déclaré plus tôt ce mois-ci que la cybersécurité de l'IA devait être prise « très au sérieux ». Il a ajouté que cela « crée également des opportunités » pour les entreprises qui peuvent tirer parti de la technologie pour repousser les attaquants.

« Si nous le faisons bien, nous pourrions nous retrouver dans un monde où l'IA rend le monde plus sûr et résout de nombreux problèmes de cybersécurité plutôt que de simplement en créer de nouveaux », a déclaré Delangue.

Tags associés

Articles similaires

Commentaires

0/500
验证码
Aucun commentaire