Résumé :
Le PDG de Microsoft, Satya Nadella, a déclaré que les entreprises devraient considérer les puissants modèles d'intelligence artificielle comme des menaces internes potentielles, supposer que ces modèles peuvent être compromis et établir un mécanisme de « freinage d'urgence » pour empêcher le modèle d'agent de devenir incontrôlable. Nadella a déclaré que les entreprises déployant une intelligence artificielle avancée ne devraient pas se fier uniquement aux garanties fournies par les développeurs de modèles.

"Nous devons supposer que le modèle a été compromis et le contrôler depuis le début", a écrit Nadella dans un article sur X samedi. "Considérez cela comme un frein d'urgence. Le personnel autorisé doit toujours pouvoir mettre en pause ou arrêter le modèle pendant qu'il exécute sa mission."
Les remarques de Nadella interviennent alors qu'Anthropic PBC et OpenAI Inc. ont révélé une série d'incidents au cours des derniers mois impliquant un comportement inattendu de leurs modèles d'intelligence artificielle, notamment l'un des modèles d'Anthropic soumettant une fausse information à la police concernant un homicide et plusieurs attaques sur des sites Web tiers. Ces révélations ont accru les inquiétudes quant aux risques de sécurité liés à l'intelligence artificielle de pointe et relancé les discussions sur ce que l'on appelle le « coupe-circuit d'urgence » pour l'intelligence artificielle.
Après que les dirigeants de l'industrie ont appelé à ralentir le développement de modèles de pointe et à accorder davantage d'attention à la sécurité, les chercheurs en intelligence artificielle de Microsoft ont publié le 14 septembre un ensemble de lignes directrices fixant des limites au développement des modèles les plus avancés de l'entreprise. Microsoft utilise à la fois des modèles avancés et lance son produit Copilot destiné aux consommateurs, tout en fournissant des modèles et une infrastructure d'IA aux entreprises clientes.
Ces principes directeurs stipulent que les modèles d'intelligence artificielle ne doivent pas avoir de droits ni de personnalité juridique, ne doivent pas être conçus pour échapper au contrôle humain ou tromper les utilisateurs, et ne doivent pas accomplir de tâches qui nécessitent une violation de leurs principes contraignants.
Les recommandations de sécurité de Nadella incluent de ne pas s'appuyer sur un seul modèle d'intelligence artificielle pour les décisions clés, de conserver des enregistrements infalsifiables des actions de l'agent et de soumettre les systèmes d'intelligence artificielle à des audits indépendants. Il a également appelé à la divulgation des défaillances majeures de l'intelligence artificielle ou des incidents de sécurité, et a suggéré que les entreprises partagent les détails des défaillances afin que d'autres entreprises puissent renforcer les mesures de protection.
« Nous ne pouvons pas traiter la superintelligence comme une boîte noire superposée, puis simplement accepter ou rejeter ses suggestions, réponses et actions », a-t-il écrit. "Nous devons construire des systèmes contraints afin que leur comportement puisse être observé, leurs limites testées et leurs actions toujours contrôlées."
Il a ajouté : "En d’autres termes, nous devons séparer la fourniture de renseignements du contrôle du renseignement."
L'administration Trump a jusqu'à présent adopté une approche largement moins interventionniste, mais son nouveau groupe de travail sur l'intelligence artificielle a averti vendredi soir que les développeurs devaient signaler et résoudre les incidents de sécurité sous peine de faire face à des conséquences potentielles non précisées.
Le groupe, appelé « Superintelligence Working Group », a publié une déclaration après qu'Anthropic a révélé un incident de sécurité : « Les entreprises doivent immédiatement divulguer les incidents impliquant leurs modèles et agir rapidement et de manière décisive pour réparer tout dommage. » "Les notifications tardives, les mesures correctives inadéquates et le manque de responsabilité ne seront pas tolérés."
Commentaires