Le PDG d'Anthropic appelle à ralentir le développement de modèles d'IA de pointe et à introduire des évaluateurs indépendants permanents

📅 2026-09-13

Résumé :

Le PDG d'Anthropic, Dario Amodei, a proposé un cadre de sécurité de l'intelligence artificielle en trois étapes, préconisant de contrôler la vitesse d'amélioration des capacités des modèles de pointe afin de gagner du temps pour la recherche sur la sécurité et l'alignement. Anthropic sera le premier à permettre à des évaluateurs tiers d'accéder à long terme à l'entreprise pour vérifier les mesures de sécurité, signaler les incidents et évaluer le processus de formation du modèle.


Anthropic mettra en place une équipe d'évaluation externe permanente

Amodei a proposé dans un article intitulé « La vitesse du progrès des frontières doit être contrôlée » que les entreprises de pointe en matière d'intelligence artificielle devraient fournir à des équipes d'évaluation tierces indépendantes un accès interne continu et proche des employés ordinaires. Les évaluateurs vérifieront que les entreprises respectent leurs engagements en matière de sécurité, enquêteront et signaleront les incidents, et procéderont à des évaluations d'alignement des modèles et de leurs processus de formation.

Anthropic s'est engagé à mettre en œuvre unilatéralement cette mesure et prévoit de fournir aux évaluateurs externes un espace de bureau, des badges d'accès, des équipements d'entreprise, ainsi qu'un espace de travail et un accès aux outils à peu près équivalents à ceux de l'équipe interne d'évaluation des risques. Des exceptions peuvent être faites pour les contenus impliquant des restrictions légales, la vie privée des clients ou des secrets commerciaux.

L'évaluateur externe sera habilité à émettre de manière indépendante des conclusions clés concernant les risques, les incidents et les pratiques de sécurité de l'entreprise. Anthropic peut effectuer des suppressions limitées d'informations impliquant la sécurité, les privilèges légaux et la confidentialité des tiers, mais ne peut pas empêcher la divulgation uniquement parce que la conclusion est défavorable à l'entreprise. Les évaluateurs peuvent également déclarer publiquement si les suppressions ont affecté leur jugement.

Le cadre en trois phases nécessite la participation de l'industrie et du gouvernement

En plus de faire appel à des évaluateurs indépendants, la deuxième phase des mesures proposées par Amodei exigerait que les sociétés d'intelligence artificielle de pointe des pays démocratiques coordonnent le développement de normes de sécurité communes et limitent la concurrence effrénée dans les capacités des modèles.

Certaines coordinations interentreprises peuvent être limitées par les lois antitrust, le gouvernement doit donc fournir un soutien institutionnel. Amodei a préconisé qu'une fois qu'un nombre suffisant d'entreprises auront accepté une supervision externe, l'industrie sera en mesure de développer des arrangements de ralentissement vérifiables basés sur des capacités modèles et des processus de formation.

La troisième phase implique une coordination internationale. Amodei a suggéré que les pays démocratiques discutent de règles de sécurité communes avec d'autres gouvernements, y compris les pays autoritaires, en commençant par des domaines d'intérêt commun tels que l'interdiction de l'utilisation de l'intelligence artificielle pour développer des armes biologiques.

Les capacités des modèles peuvent s'améliorer plus rapidement que le contrôle des risques

Amodei a déclaré que l'amélioration récente de la capacité des modèles d'intelligence artificielle à participer au développement de modèles de nouvelle génération pourrait accélérer les itérations technologiques. Si les capacités des modèles continuent de s'améliorer rapidement, la capacité des humains à comprendre, évaluer et contrôler les systèmes associés risque de ne pas suivre le rythme.

Il estime que des progrès substantiels peuvent être réalisés au cours des deux prochaines années dans des domaines tels que l'interprétabilité des modèles, l'évaluation de la sécurité, la recherche sur l'alignement et les spécifications opérationnelles. Contrôler correctement la vitesse de développement des capacités peut permettre de gagner du temps pour ces mesures sans obliger l’industrie à arrêter complètement la recherche et le développement en matière d’intelligence artificielle.

Le PDG d'OpenAI, Sam Altman, a ensuite soutenu l'introduction d'évaluateurs indépendants et a déclaré qu'OpenAI adopterait des dispositions similaires. Elon Musk a également publiquement souscrit à l'appel d'Amodei à ralentir le développement du modèle.

Tags associés

Articles similaires

Commentaires

0/500
Captcha (click to refresh)
Aucun commentaire