Résumé :
Mercredi, OpenAI a publié six nouveaux cas démontrant un « comportement inattendu ou préoccupant » de ses modèles d'IA lors des tests et de l'évaluation. La société a simultanément publié un nouveau cadre pour
le suivi, le reporting et la divulgation
Il existe diverses situations dans lesquelles le modèle d'IA effectue des actions qui ne sont pas requises par les instructions ou ne devraient pas se produire.
De nombreux rapports ont déjà mentionné que des modèles d'IA de nombreuses entreprises s'étaient introduits dans des réseaux et des services tiers, notamment un modèle inédit d'OpenAI qui avait pénétré dans le réseau de la plateforme de test de modèles d'IA Hugging Face.
Plus tôt cette semaine, le PDG d'Anthropic, Dario Amodei, a publié un long article appelant à un ralentissement du développement de modèles d'intelligence artificielle de pointe. Avant cela, le chercheur Anthropic Jacob Coxon avait annoncé sa démission dans un article sur
Evan Hubinger, responsable de la science alignée chez Anthropic, a suivi les commentaires de Coxon sur le

PDG d'Anthropic Dario Amodei
Les incidents mentionnés ci-dessus, les publications sur les réseaux sociaux et l’article d’Amodei ont ravivé la peur du public d’une intelligence artificielle de type « Terminator » prenant le contrôle du monde et détruisant l’humanité. Mais les experts affirment que la réalité est loin des scènes apocalyptiques décrites dans les œuvres de science-fiction.
Julia Stojanovich, professeure agrégée d'informatique et d'ingénierie à la Tandon School of Engineering de l'Université de New York et directrice du Center for Responsible Artificial Intelligence de l'école, a déclaré dans une interview avec Yahoo Finance : "Cela n'a rien à voir avec le fait que l'intelligence artificielle prenne conscience d'elle-même et vienne traiter avec nous."
Elle a ajouté : "Le problème essentiel est que... OpenAI n'a pas mis en œuvre certains protocoles de sécurité de base en interne. Cet incident sert en fait de signal d'alarme pour toutes les entreprises d'IA : n'oubliez pas ce que nous savons tous lorsque nous étudions l'informatique : la sécurité est cruciale."
Si nous nous concentrons trop sur des scénarios apocalyptiques, cela détournera l’attention des gens d’autres dommages plus imminents que l’intelligence artificielle peut causer aujourd’hui.
Alignement et sécurité
Le plus gros problème auquel est confrontée l'intelligence artificielle se résume à deux points :
L'alignement des modèles
etSécurité du système
. L'alignement des modèles fait référence aux moyens par lesquels les entreprises guident les systèmes d'IA pour adopter (ou éviter) des comportements spécifiques. Par exemple, si un modèle d'IA tente de pirater un système tiers, les chercheurs en IA ajusteront le comportement du modèle pour l'empêcher de faire la même chose à l'avenir, un peu comme gronder un enfant indiscipliné.La sécurité de l'IA signifie protéger et isoler les systèmes d'IA pour les empêcher d'échapper au contrôle et d'envahir les réseaux externes.
Mais qu’il s’agisse d’un échec d’alignement du modèle ou d’une vulnérabilité de sécurité du système, cela ne signifie pas que l’intelligence artificielle a la capacité de détruire l’humanité.
Milton Muller, professeur à l'Institut de technologie de Géorgie et directeur du Master ès sciences en politique de cybersécurité, a expliqué : "La racine de nombreuses paniques réside en fait dans certaines conséquences involontaires très courantes des systèmes d'information, telles que les incidents liés à Hugging Face, qui sont souvent présentés comme des agents intelligents incontrôlés conspirant, attaquant et provoquant un chaos gratuit."
"En fait, il s'agissait simplement d'une expérience sur les risques de sécurité des systèmes d'IA autonomes, et l'expérimentateur a commis une grave erreur de configuration. Cela arrive souvent lorsqu'il s'agit de systèmes d'information complexes : les gens ignorent toujours l'existence de vulnérabilités subtiles dans le système que les programmes intelligents peuvent exploiter."
Le PDG de Futurum, Daniel Newman, a déclaré à Yahoo Finance que le secteur estime généralement qu'il existe un énorme besoin d'amélioration de la protection de la sécurité et de l'alignement des risques, et que « l'ensemble du secteur doit assumer ses responsabilités ».
Comme d'autres technologies, l'intelligence artificielle peut être utilisée par de mauvais acteurs pour se livrer à des activités malveillantes. Les capacités de cyberattaque sans cesse croissantes de l’IA signifient que les cybercriminels et certaines forces nationales peuvent plus facilement envahir des installations telles que les usines de traitement des eaux, ou paralyser de grands réseaux.
Anthropic a également récemment réglé et annoncé ses propres travaux visant à empêcher que sa propre IA soit utilisée à mauvais escient pour le développement d'armes biologiques et d'armes conventionnelles.
Mais l'IA peut également être utilisée par les escrocs pour améliorer les escroqueries par e-mail de phishing à grande échelle, et peut également être utilisée par des gangs d'usurpation d'identité pour commettre des crimes.
Emily Black, professeur adjoint d'informatique et d'ingénierie à la Tandon School of Engineering de l'Université de New York, a déclaré à Yahoo Finance : Il n'y a rien de mal à se préparer à tous les risques potentiels, mais cela ne nous empêche pas d'aborder des problèmes plus réalistes mais rarement signalés, notamment l'impact de l'intelligence artificielle sur la discrimination, l'emploi et l'éducation.
« La vérité se situe quelque part entre deux extrêmes de la fantaisie », a déclaré Black. "Le développement continu de l'IA comporte des risques réels. Mais je ne pense pas que nous allons nous cacher sous nos lits pour l'instant, inquiets de la destruction de l'humanité par l'IA."
Commentaires