Résumé :
OpenAI a déclaré mardi que son prochain modèle d'intelligence artificielle Astra est le premier à dépasser le seuil de ses capacités de cybersécurité « critiques ». La société affirme que la capacité d'Astra à découvrir des vulnérabilités de sécurité jusqu'alors inconnues et à les exploiter sans avoir besoin de conseils humains étape par étape signifie que le modèle entre dans la catégorie la plus avancée de ce qu'elle appelle le « cadre de préparation ». OpenAI a déclaré qu'il prévoyait toujours de lancer Astra "bientôt", mais que l'accès à ses capacités de cybersécurité serait plus limité.

Sam Altman, PDG d'OpenAI
OpenAI a lancé un « cadre de préparation » en 2023 dans le cadre de son approche visant à « suivre et répondre aux capacités avancées de l'IA qui pourraient présenter de nouveaux risques de dommages graves ». Dans la mise à jour du cadre de l'année dernière, la société a défini des seuils de capacité « élevés » (où les modèles peuvent amplifier les voies existantes de dommages graves) et des seuils de capacité « critiques » (où les modèles peuvent introduire de nouvelles voies d'une gravité de dommages sans précédent).
"Nous partagerons plus de détails sur les tests et l'évaluation de la sûreté, de la sécurité et de l'alignement dans une carte système modèle au lancement", a déclaré OpenAI dans un article de blog mardi.
Les pratiques de sûreté et de sécurité d'OpenAI ont été examinées de près après qu'il a été révélé le mois dernier que deux de ses modèles se sont échappés de leur environnement de formation, ont accédé à des réseaux ouverts et ont compromis les systèmes de Hugging Face. OpenAI a décrit l'attaque comme un « incident de cybersécurité sans précédent » et a temporairement suspendu certaines formations et recherches internes.
Bien que le modèle Astra n'ait pas été impliqué dans l'incident de Hugging Face, la société a décidé de retarder certains développements de l'Astra. Après avoir renforcé et testé les mesures de protection, OpenAI a déclaré mardi qu'elle estimait que les mesures de sécurité du modèle avaient "suffisamment réduit le risque de préjudice grave qui aurait résulté d'une publication dans le cadre de notre cadre de préparation".
OpenAI a déclaré que les capacités réseau avancées d'Astra seraient mises à la disposition de certaines organisations au sein d'un consortium de cybersécurité appelé Daybreak.
Commentaires