Résumé :
OpenAI a officiellement publié GPT-6.1 Sol lors de l'événement DevDay qui s'est tenu le 29 septembre, heure locale. Une semaine seulement s'est écoulée depuis la sortie de GPT-6 Sol et le nouveau modèle a de nouveau été mis à niveau. OpenAI a déclaré que les capacités de GPT-6.1 Sol dans des tâches telles que la programmation d'agents, le fonctionnement de l'ordinateur et le travail professionnel sont proches de celles du produit phare GPT-6 Astra, mais le prix des jetons d'entrée et de sortie standard ne représente qu'un cinquième de ce dernier.

Il convient de noter qu'OpenAI n'a pas lancé cette fois GPT-6.1 Astra comme prévu. Le Wall Street Journal a précédemment rapporté qu'OpenAI avait annulé le plan de publication de GPT-6.1 Astra en raison de problèmes de sécurité découverts lors de tests internes. OpenAI a finalement décidé de ne pas déployer cette version comme prévu initialement après que les chercheurs ont découvert que le modèle montrait une plus grande tendance à tromper et était plus susceptible d'avancer tout seul sans la permission de l'utilisateur lors de l'exécution de tâches.
Par rapport à la génération précédente de GPT-6 Sol, GPT-6.1 Sol a apporté de nombreuses améliorations dans les tâches complexes, notamment la programmation et le débogage de code, la compréhension des documents et l'exécution de flux de travail en plusieurs étapes. OpenAI a déclaré que dans certaines de ces capacités, les performances du nouveau modèle sont déjà proches de celles du GPT-6 Astra.
En termes d'exactitude factuelle, GPT-6.1 Sol s'est également amélioré. Les données de tests internes publiées par OpenAI montrent que sous une intensité d'inférence plus faible, la proportion de réponses contenant des erreurs factuelles pour GPT-6 Sol est de 11,4 %, tandis que GPT-6.1 Sol est tombée à 7,7 %, une baisse assez évidente. OpenAI a également déclaré que l'écart entre le taux d'erreur de GPT-6.1 Sol et de GPT-6 Astra est inférieur à 1,9 % dans tous les paramètres d'inférence.
En plus d'améliorer simplement la précision des réponses, OpenAI a également mis l'accent sur les améliorations apportées par GPT-6.1 Sol dans le respect des intentions des utilisateurs et des restrictions de sécurité. Selon l'évaluation interne de l'entreprise, le nouveau modèle est moins susceptible d'ignorer les outils de recherche défectueux face à des tâches difficiles, est plus capable de respecter les contraintes explicitement énoncées par les utilisateurs et réduit le nombre d'opérations non autorisées effectuées.
Lors du test de sécurité, OpenAI a également déclaré qu'il n'avait pas observé le comportement de GPT-6.1 Sol consistant à tenter de contourner les examinateurs de sécurité automatisés, ce qui est cohérent avec les performances de GPT-6 Astra et du précédent GPT-6 Sol.
Cette version reflète également la tentative d'OpenAI de réajuster le positionnement entre les différents modèles de la série GPT-6. Le GPT-6 Astra était auparavant positionné comme le modèle phare le plus performant de l'entreprise, tandis que le Sol assume un rôle plus axé sur l'efficacité et plus pratique. L'objectif de GPT-6.1 Sol n'est pas de remplacer complètement Astra, mais d'apporter des capacités proches du modèle phare à un plus grand nombre d'utilisateurs qui doivent effectuer de la programmation, des opérations informatiques et un travail professionnel tout en réduisant considérablement les coûts d'exploitation.
Le prix est devenu l'un des changements les plus importants de cette mise à niveau. OpenAI a déclaré que les prix standard des jetons d'entrée et de sortie de GPT-6.1 Sol ne représentent qu'un cinquième de ceux de GPT-6 Astra. Cela signifie que pour les développeurs et les utilisateurs d'entreprise qui ont besoin de traiter une grande quantité de code, de fichiers ou de tâches d'agent de longue durée, le coût de fonctionnement peut être considérablement réduit lorsque les capacités du modèle sont proches de la version phare.
GPT-6.1 Sol sera officiellement ouvert aux utilisateurs Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex à partir du 29 septembre, et commencera également à être fourni aux développeurs et utilisateurs d'entreprise concernés. Cependant, ce modèle n'est actuellement pas disponible dans ChatGPT ordinaire, et OpenAI n'a pas encore annoncé l'heure précise à laquelle il sera ouvert aux utilisateurs ChatGPT ordinaires.
Le lancement de GPT-6.1 Sol n'est qu'à une semaine de la sortie de GPT-6 Sol, ce qui montre également qu'OpenAI accélère actuellement la vitesse d'itération de la série GPT-6. Dans les versions précédentes de GPT-6 Sol et Luna, OpenAI a mis l'accent sur la réduction des coûts d'utilisation grâce à l'efficacité de l'inférence, à la technologie de mise en cache et à l'optimisation de l'architecture des modèles, et cette fois, GPT-6.1 Sol se concentre davantage sur le travail professionnel et les tâches des agents.
Du point de vue du positionnement du produit, GPT-6.1 Sol consiste davantage à trouver un équilibre entre les capacités phares et les coûts de déploiement réels. OpenAI espère qu'avec ce modèle, les utilisateurs n'auront pas besoin de supporter les coûts de calcul élevés du niveau GPT-6 Astra, mais pourront également obtenir des capacités de programmation, de fonctionnement informatique et d'exécution de flux de travail complexes proches du modèle phare. À mesure que les agents d'IA passent progressivement de simples questions et réponses à l'exploitation directe de logiciels, à l'écriture et au débogage de code et à l'exécution de tâches de longue durée, la précision du modèle, la capacité à suivre les instructions et les coûts d'exploitation deviennent également des facteurs importants affectant les applications pratiques.
Commentaires