OpenAI a officiellement ouvert aujourd'hui l'accès mondial à sa série de modèles GPT‑5.6 de dernière génération. Les modèles concernés sont passés de l’étape « aperçu limité », qui n’était auparavant disponible que pour quelques partenaires de confiance, à une version complète pour tous les utilisateurs. La série GPT‑5.6 comprend trois modèles avec des positions différentes : le produit phare GPT‑5.6 Sol, le GPT‑5.6 Terra équilibré et le GPT‑5.6 Luna, léger et économique.

Parmi eux, GPT‑5.6 Sol se positionne comme le modèle phare, ciblant des scénarios haut de gamme tels que le raisonnement complexe, le développement de code, la recherche scientifique, la sécurité des réseaux et les tâches d'agent de longue durée. GPT‑5.6 Terra est le « modèle équilibré » de la famille. Les responsables affirment que ses performances globales peuvent rivaliser avec GPT‑5.5, alors que son coût ne représente qu'environ la moitié de ce dernier. GPT‑5.6 Luna est le modèle le plus petit et le moins coûteux de la série, mieux adapté aux charges de travail nécessitant une vitesse élevée et un faible coût.
Dans GPT‑5.6, OpenAI introduit un nouveau paramètre « effort de raisonnement maximal ». Les utilisateurs peuvent activer cette option lorsqu'ils utilisent le modèle Sol pour améliorer encore les performances des tâches de raisonnement complexes. Dans le même temps, OpenAI a également lancé un nouveau « mode ultra » qui planifie la collaboration de plusieurs sous-agents pour dépasser la limite supérieure des capacités d'un seul agent et accélérer les flux de raisonnement complexes.
Une série de résultats de tests de référence officiels montrent que GPT‑5.6 Sol a établi de nouveaux records de l'industrie dans un certain nombre d'évaluations professionnelles pour le raisonnement des agents, la génération de code et l'analyse de sécurité. Dans le test Agents' Last Exam, GPT‑5.6 Sol avec inférence adaptative activée a obtenu un score de 53,6, 13,1 points de plus que Claude Fable 5 ; même avec des paramètres d'inférence moyens, Sol a quand même battu Fable 5 de 11,4 points, soit environ un quart du coût estimé.
Dans le test Artificial Analysis Intelligence Index, GPT‑5.6 Sol avec un effort d'inférence maximal activé a obtenu un score presque identique à Fable 5, tout en accomplissant la tâche 61 % plus rapidement pour environ la moitié du coût estimé. Dans l'index des agents de codage d'analyse artificielle, GPT‑5.6 Sol (inférence maximale) a obtenu un score de 80, établissant un nouveau record du secteur, 2,8 points de plus que Fable 5. Dans le même temps, le nombre de jetons de sortie, la durée des tâches et le coût estimé ont été réduits d'environ la moitié, voire moins.
Dans les tests Terminal‑Bench 2.1 et DeepSWE v1.1 pour les flux de travail d'ingénierie complexes et de base de code réel, GPT‑5.6 Sol a obtenu de nouveaux résultats parmi les meilleurs du secteur. Dans le test BrowseComp pour les tâches de navigation des agents, GPT‑5.6 Sol a obtenu un score de 92,2 %, établissant à nouveau un nouveau record. Dans le test OSWorld 2.0, qui simule un environnement de système d'exploitation, GPT‑5.6 Sol a obtenu un score de 62,6 %, surpassant Opus 4.8 tout en utilisant 85 % de jetons de sortie en moins.
En termes d'évaluations liées à la sécurité, GPT‑5.6 Sol présente également des avantages significatifs. Dans le test ExploitBench 1, GPT‑5.6 Sol a obtenu un score de 73,5 %, tandis qu'avec un budget de jetons de sortie similaire, GPT‑5.5 n'a obtenu qu'un score de 47,9 %. Dans le test ExploitGym 2, GPT‑5.6 Sol a amélioré le taux de réussite maximal de GPT‑5.5 de 15,1 % à 24,9 % dans un délai de deux heures, et s'est encore amélioré à 33,7 % si le temps était prolongé à six heures. Dans le test SEC‑Bench Pro pour l'analyse des titres et de la sécurité, GPT‑5.6 Sol a obtenu un score de 71,2 %, nettement supérieur aux 45,8 % de GPT‑5.5, tout en améliorant les performances de latence.
OpenAI a également annoncé les tarifs de la série GPT‑5.6. Les frais pour GPT‑5.6 Sol sont de 5 USD par million de jetons d'entrée et de 30 USD par million de jetons de sortie ; GPT‑5.6 Terra coûte 2,5 USD par million de jetons d'entrée et 15 USD par million de jetons de sortie ; GPT‑5.6 Luna représente 1 USD par million de jetons d'entrée et 6 USD par million de jetons de sortie. De plus, OpenAI fournira un « mode rapide » de GPT-5.6 Sol via Cerebras, qui peut atteindre une vitesse de génération allant jusqu'à 750 jetons par seconde.
En termes de disponibilité, OpenAI a déclaré que GPT‑5.6 sera lancé dans ChatGPT, Codex et OpenAI API dans les prochaines 24 heures. Les utilisateurs de ChatGPT Plus, Pro, Business et Enterprise peuvent accéder à GPT‑5.6 Sol avec des paramètres de force d'inférence moyens et élevés ; Les utilisateurs de ChatGPT Pro et Enterprise peuvent également choisir GPT‑5.6 Sol Pro, conçu pour les tâches complexes.
Pour les utilisateurs de ChatGPT Free and Go, OpenAI donnera accès à GPT‑5.6 Terra. Les utilisateurs de ChatGPT Plus, Pro, Business et Enterprise peuvent choisir librement entre les modèles GPT‑5.6 Sol, Terra et Luna et définir différents niveaux d'effort d'inférence pour chaque modèle. Le nouveau « mode max » sera disponible pour tous les utilisateurs utilisant GPT‑5.6 dans ChatGPT Work et Codex.
Dans le produit ChatGPT Work, le mode GPT‑5.6 Sol ultra sera disponible pour les utilisateurs Pro et Enterprise pour répondre aux besoins de flux de travail plus complexes au niveau de l'entreprise ; dans Codex, le nouveau mode ultra est disponible pour les utilisateurs des forfaits d'abonnement Plus et supérieurs. Avec le lancement officiel de GPT‑5.6 Sol, Terra et Luna, la famille de modèles généraux de nouvelle génération d'OpenAI est pleinement entrée dans la phase de déploiement des entreprises et des développeurs, et la concurrence autour des performances d'inférence, de la rentabilité et du flux de travail des agents s'est encore intensifiée.