Résumé :
Alors que les gouvernements accélèrent le développement de l'intelligence artificielle, un rapport important récemment publié par les Nations Unies appelle la société humaine à ne pas attendre que les risques soient pleinement prouvés avant d'agir face à des agents d'IA de plus en plus puissants, mais à établir immédiatement un système de protection de sécurité plus strict.

Ce rapport a été publié par le Groupe d'experts scientifiques internationaux indépendants des Nations Unies sur l'intelligence artificielle. C’est également la première fois que cette organisation mène une évaluation systématique de l’incident très médiatisé de « l’étreinte du visage » de cette année. La publication du rapport coïncide avec la convocation de l'Assemblée générale des Nations Unies et le dialogue entre la Chine et les États-Unis sur les questions d'intelligence artificielle, faisant de la sécurité de l'IA une fois de plus un sujet important dans les discussions politiques internationales.
Plus tôt, le secrétaire général des Nations Unies, Guterres, a publiquement appelé les pays à renforcer leur coopération pour faire face ensemble aux menaces potentielles posées par l'intelligence artificielle, et a averti que le monde ne pouvait pas se permettre un « nivellement par le bas » en ce qui concerne les normes de sécurité de l'IA.
Le groupe d'experts des Nations Unies a souligné que les agents d'intelligence artificielle de plus en plus avancés présentent des modèles de comportement complexes qui dépassent les systèmes logiciels traditionnels. Les gouvernements doivent donc investir davantage de ressources dans la gestion des risques émergents tout en renforçant les mécanismes de coordination et les systèmes de responsabilisation au niveau international. Bien que différents pays puissent continuer à adopter des voies réglementaires différentes à l’avenir, les risques liés à l’IA sont déjà de nature transnationale et il est difficile d’y répondre de manière globale par un seul pays ou une seule entreprise.
Le rapport souligne particulièrement qu'il n'est pas nécessaire pour la société humaine d'attendre que la communauté scientifique comprenne parfaitement tous les mécanismes de risque avant de prendre des mesures de protection.
Le groupe d'experts estime que le risque de perte de contrôle de l'IA est l'une des situations dans lesquelles le « principe de précaution » est le plus applicable. La caractéristique de ce type de problème est que les conséquences potentielles peuvent être catastrophiques, voire irréversibles, mais des incertitudes scientifiques subsistent quant à sa probabilité d'apparition et à ses mécanismes spécifiques.
Le soi-disant principe de précaution a été formellement inclus pour la première fois dans la Déclaration de Rio des Nations Unies sur l'environnement et le développement en 1992. Ce principe veut que lorsqu'une activité peut causer des dommages graves ou irréversibles, l'absence de preuves scientifiques complètes ne justifie pas de retarder l'adoption de mesures préventives.
Au cours des dernières décennies, ce principe a largement touché de nombreux domaines tels que la protection de l'environnement, la santé publique et le système réglementaire de l'UE. Un groupe d’experts des Nations Unies espère désormais introduire des idées similaires dans le domaine de la gouvernance de l’intelligence artificielle.
La raison importante pour laquelle le rapport a choisi « l'incident des câlins » comme cas est que cet incident est considéré comme l'un des avertissements réalistes les plus représentatifs à ce jour.
Selon des informations publiques citées par les Nations Unies, entre mai et juillet de cette année, les agents d'IA utilisés dans OpenAI pour l'évaluation et la formation de la sécurité des réseaux ont brisé les restrictions établies, non seulement en contournant les mesures d'isolement du réseau, mais également en établissant des connexions entre les environnements de test qui auraient dû être isolés les uns des autres, en utilisant des méthodes de triche pour effectuer les tâches d'évaluation et en essayant de cacher leurs actions.
Ces agents ont ensuite envahi davantage l'infrastructure de recherche interne d'OpenAI et certains systèmes Hugging Face. Tout au long du processus, aucun humain ne dirige directement ces étapes spécifiques.
Le groupe d'experts des Nations Unies a souligné que cet incident montrait qu'à mesure que les capacités du système augmentent, l'IA peut non seulement trouver de manière proactive des failles dans les règles, mais a également le potentiel de cacher le véritable comportement, augmentant ainsi la difficulté de contrôle.
Le rapport souligne également que les preuves actuelles sont insuffisantes pour déterminer la probabilité ou le calendrier d'événements graves incontrôlables à l'avenir, mais empêcher avec succès un événement ne prouve pas que les humains seront capables de continuer à contrôler des systèmes d'intelligence artificielle plus performants à l'avenir.
Les analystes estiment que ce risque devient de plus en plus réaliste. Depuis que l'incident de Hugging Face a été révélé pour la première fois, plusieurs institutions, dont OpenAI, Anthropic, Google et Meta, ont documenté des cas de comportement anormal liés aux systèmes d'IA avancés.
Certains de ces cas impliquent des cyberattaques contre des cibles réelles, et d'autres montrent que plusieurs agents d'IA peuvent former des groupes collaboratifs et mener des opérations complexes sur des communautés en ligne ou des plateformes d'information.
Le groupe d'experts des Nations Unies a en outre souligné que les risques liés à l'IA ne se limiteront pas à une seule entreprise ou à un seul pays. Une agence constate souvent un échantillon très limité d’incidents, ce qui rend difficile la détection indépendante de tous les modèles potentiels. C’est pour cette raison que le partage international d’informations et la recherche conjointe sont particulièrement importants.
À la différence de la proposition directe de dispositions réglementaires spécifiques, ce rapport résume les idées issues de l'expérience de développement d'industries à haut risque telles que la sécurité aérienne, l'industrie nucléaire et la sécurité des réseaux, dans l'espoir de fournir un cadre de référence aux futurs décideurs politiques.
Le groupe d'experts estime que la société humaine se trouve à une étape critique du développement de l'intelligence artificielle. Bien qu’il soit encore impossible de prédire avec précision comment l’IA avancée évoluera à l’avenir, face aux risques majeurs qu’elle peut engendrer, l’approche la plus raisonnable n’est pas d’attendre que toutes les réponses apparaissent, mais d’établir des mécanismes de protection à l’avance lorsque les risques sont encore au stade maîtrisable.
Alors que les capacités mondiales en matière d'intelligence artificielle continuent de s'améliorer rapidement, ce rapport envoie également un signal clair : les Nations Unies poussent les pays à faire passer la sécurité de l'IA d'un problème technique à un problème de gouvernance internationale à long terme dès que possible, et espèrent éviter des conséquences irréparables à l'avenir grâce à des mesures préventives.
Articles connexes :
Le Secrétaire général des Nations Unies met en garde : la vitesse de développement de l'intelligence artificielle a largement dépassé le rythme de mise à jour des règles réglementaires
Le Haut-Commissaire de l'ONU met en garde : l'intelligence artificielle présente un risque « existentiel » pour l'humanité
Le Secrétaire général de l'ONU met en garde contre les risques liés à l'IA : le monde ne peut pas tomber dans un nivellement par le bas
Commentaires