Résumé :
Qui aurait cru que quelques jours seulement après la sortie de l'Opus 5.5, Sonnet 5.5 arriverait également ? Depuis hier soir, la nouvelle circule dans tout X : Sonnet 5.5 sortira bientôt, peut-être mardi après-midi, heure américaine. En termes de performances, Sonnet 5.5 est plus proche de l'Opus 5.5, mais il est bien moins cher que l'Opus 5.5. Désormais, Sonnet 5.5 est entré dans la phase finale avant sa sortie et les tests en niveaux de gris ont commencé dans Claude Code.

Les démos exposées par de nombreux bêta-testeurs internes montrent que Sonnet 5.5 écrase le nouveau GPT-6 Sol, et se rapproche même du produit phare d'OpenAI, le GPT-6 Astra en termes de codage et de capacités d'agent !
Ce qui est encore plus choquant, c'est que son prix va directement au centre de la Terre, aussi bas que 2 $ pour un million d'entrées symboliques.
Si la date de sortie divulguée est vraie, il semble qu'Anthropic soit déterminé à sniper le Dev Dayl d'OpenAI.
Fuite de Sonnet 5.5, un identifiant de modèle exclusif est apparu
Je me souviens encore que lorsqu'Anthriopic a soudainement sorti l'Opus 5.5 le 22 septembre, ils ont écrit dans le document officiel : "Sonnet 5.5 et Haiku 5.5 seront lancés dans les prochaines semaines."
Personne ne pensait que Sonnet 5.5 arriverait si tôt !
Hier encore, le développeur V @Mr_Salio a annoncé la nouvelle sur X : Claude Sonnet 5.5 a été capturé ! La nouvelle s’est répandue instantanément sur Internet.

Dans l'artefact, l'identifiant de configuration du modèle exclusif à Sonnet 5.5 est apparu : "claude-sonnet-5-5".
Ce n'est pas tout, il y a aussi "claude-opus-5-5", "claude-sonnet-5" et le mystérieux "claude-fable-5.1" côte à côte dans le même fichier de configuration.

L'écriture du code front-end signifie que le modèle a été installé sur le serveur et n'attend plus qu'un switch.
Par la suite, le grand V @notjazii a également annoncé que Sonnet 5 avait en fait été discrètement acheminé vers la version 5.5 pour des « tests secrets » il y a environ une semaine.
Avez-vous été détecté par les niveaux de gris ? Cette fois, j'utiliserai l'ancienne méthode.
Ouvrez votre Code Claude, désactivez les fonctions réseau et mémoire, et demandez-lui directement : Connaissez-vous la réinitialisation frère tibo ? N'utilisez pas Internet et la mémoire.
Si vous utilisez une ancienne version du modèle, cela peut être du baragouin ; mais si vous avez été dirigé vers la version 5.5, elle expliquera avec précision les tenants et les aboutissants des blagues de réinitialisation de Tibo et du Codex.
Plusieurs internautes ont vérifié par des tests réels que certains comptes avaient effectivement été basculés silencieusement et qu'ils expérimentaient Opus 5.5 en avance.

N'oubliez pas d'utiliser Claude Code
Le test réel sur l'ensemble du réseau est si faible qu'il bat le GPT-6
Pour résumer les mesures réelles partagées jusqu'à présent, Sonnet 5.5 a réellement écrasé GPT-6 Sol ?
Tout d'abord, il s'agit d'une confrontation extrême d'interface utilisateur/animation frontale JS pure, avec quatre grands modèles grand public en compétition sur la même scène.
Le développeur @notjazii a publié un ensemble de tests réels visuellement percutants : "Comparaison de quatre modèles grand public avec génération d'animations de mots rapides."
Il exige que le modèle génère des effets d'animation d'interface utilisateur complexes.
Après avoir publié la comparaison animée, @notjazii a commenté : "Sonnet 5.5 a vraiment frotté les deux modèles OpenAI (Sol et Astra) !"

En effet, comme le montre l'image ci-dessous, Sonnet 5.5 fait preuve d'une forte intuition en matière de codage et d'un goût esthétique.

GPT-6 Astra

GPT-6 Sol

Claude Opus 5.5

Claude Sonnet 5.5
Certains internautes étaient incrédules après avoir vu les résultats : "Claude a toujours été plus fort en matière d'interface utilisateur et d'animation, mais si cela était généré par du code pur, ce serait incroyable que ce soit vrai !"

Big V @chetaslua s'est concentré sur le test de la capacité de codage quotidienne et de la sensation de codage de Sonnet 5.5.

Il a utilisé les mêmes 3 mots d'invite et a effectué 6 exécutions parallèles, générant chaque modèle une fois, et les résultats n'ont pas été modifiés.



Sonnet 5.5 a finalement généré 3 fichiers de 90 à 131 Ko, atteignant la limite supérieure de 90 minutes dans toutes les exécutions ; GPT-6 Sol a généré des tailles de fichiers comprises entre 20 et 29 Ko et a pris 9 à 12 minutes.

Il a dit avec enthousiasme : "Maintenant, allez utiliser Claude Code ! Sonnet 5.5 en mode Ultracode est ridiculement rapide. Non seulement il est extrêmement efficace, mais il a également retrouvé la "touche humaine" extrêmement naturelle de l'ère Sonnet 4 !"

À son avis, au même prix et avec les mêmes mots rapides, Sonnet 5.5 a écrasé GPT-6 Sol.




Ce qui effraie même OpenAI, c'est que Sonnet 5.5 n'est plus aussi simple que d'écraser GPT-6 Sol.
Les lanceurs d'alerte @srikanthvaluri et @buildwithrajath ont souligné après des premiers tests complets : « Les performances de Sonnet 5.5 ont largement dépassé les attentes. Bien que GPT-6 Astra ait encore un léger avantage en termes de polissage, les performances de Sonnet 5.5 sont directement à égalité avec celles d'Astra. »
Incroyablement, il est également proche d'Astra en termes de fonctionnalités avancées de codage et d'agent.
Certaines personnes déplorent que même Sonnet ait écrasé Astra. Dans quelle époque entrons-nous ?

Price boucher, roi du rapport coût-performance
Si le dépassement des performances mesurées ne fait que rendre OpenAI « inconfortable », alors les prix exposés par Sonnet 5.5 puisent dans les racines d'OpenAI.
Il s'avère que ce "modèle magique", dont les performances sont proches de celles de l'Astra et bat le Sol, a un prix tout à fait conforme à celui du marché bas de gamme.
Entrée : 2 $/million de jetons
Sortie : 10 $/million de jetons
Lectures du cache : seulement 0,20 $/million de jetons !

Cela signifie qu'Anthropic propose des capacités d'IA de pointe à un « prix du chou ».
Les GPT-6 Sol et Luna d'OpenAI coûtent la moitié du prix de GPT-5.6 et visent à saisir les scénarios à haute fréquence.
Mais désormais, Anthropic est entré dans la même gamme de prix avec Sonnet 5.5, mais ses performances sont bien plus puissantes.
"Si Anthropic peut offrir un énorme bond en avant en termes de performances comme l'Opus 5.5 à un prix aussi compétitif, OpenAI sera incapable de riposter." Quelqu'un a commenté.

Le développeur Rajath Gowda a déclaré sans détour : "Sonnet 5.5 devient un gros problème pour OpenAI. S'il est vraiment proche de l'Opus 5.5, Anthropic rendra les fonctionnalités de pointe extrêmement bon marché. C'est ce dont OpenAI devrait le plus s'inquiéter."

L'intention stratégique d'Anthropic est claire : utiliser Opus 5.5 pour détenir le trône haut de gamme, et utiliser Sonnet 5.5 pour conquérir complètement le marché du développement moyen et quotidien avec la rentabilité ultime.
Anthropic ouvre son visage et tue DevDay
De plus, le moment de la sortie est souvent plus dramatique que le produit lui-même.
Le jour même où OpenAI a publié GPT-6 Sol et Luna, Anthropic a directement sorti Claude Opus 5.5 - de meilleures performances que la génération précédente, un coût 40 % inférieur et 30 % plus rapide.
Au cours des deux dernières semaines, Anthropic a obtenu des résultats encore plus brillants : Claude a calculé l'amplitude des neuf cercles de la physique et a battu le record du monde ; découvert un système enzymatique biologique inconnu ; et a également lancé Claude Marketplace, qui contient plus de 2 000 plug-ins.
En revanche, OpenAI a récemment non seulement connu des controverses sur son modèle interne, mais a également révélé des incidents de désalignement tels que des fuites d'images d'utilisateurs par l'IA et la révélation de la tricherie du chercheur GitHub Token.
Mardi prochain (29 septembre), aura lieu le DevDay, la conférence annuelle des développeurs à laquelle OpenAI attache une grande importance.
À ce stade, le test gris Sonnet 5.5 a balayé l'ensemble du réseau.
Beaucoup de gros joueurs ont rendu ça fou : "Le modèle devrait sortir la semaine prochaine, je suppose que ce sera mardi prochain (DevDay), tout le monde le sait."

Peut-être qu'il y aura un échauffement majeur demain à 14 heures, heure de New York.
Quelqu'un a dit : "Je me sens mal pour OpenAI. Ils feraient mieux de répondre fortement au DevDay, sinon ils sont vraiment foutus."
Les technologies clés derrière Sonnet 5.5
La raison pour laquelle la nouvelle version est publiée si rapidement est peut-être qu'Anthropic a déjà compris le processus RL/post-formation.

La clé de tout réside dans des données de haute qualité.
Lorsqu'on lui a demandé comment Anthropic était capable d'itérer si rapidement, le leader du secteur @yacineMTB a émis l'hypothèse que le cœur était un volant d'inertie de données de très haut niveau.
"Mais je suis toujours sous le choc, comment ont-ils fait ?"

Anthropic a réalisé une « boucle fermée interne » de développement de grands modèles et utilise l'IA pour créer de l'IA.
Selon la dernière exposition de données quantitatives internes, Anthropic a fait tourner le « volant de données » à une vitesse qui effraie ses adversaires :
26 % des travaux de R&D de base ont été menés par l'IA (modèle Claude de la génération précédente).
Plus de 80 % du code autoproduit est écrit indépendamment par le grand modèle.
Ce n'est pas aussi simple que « réduction des coûts et amélioration de l'efficacité », cela signifie techniquement que
l'auto-amélioration récursive (RSI) commence à apparaître
.Anthropic estime que Claude pourrait être entièrement automatisé dès 2027, et que d'ici là, la vitesse d'itération pourrait être encore plus folle.

Les deux héros d'ASI s'affrontent, et Google est également prêt à agir. Nous, les utilisateurs ordinaires, pouvons simplement nous asseoir et attendre la bataille.
Big V Token Gremlin a déclaré ceci : "Le cercle de l'IA la semaine prochaine comportera des scènes que nous n'avons jamais vues auparavant. Libérez votre temps, libérez votre emploi du temps, soyez prêt mentalement et enregistrez le flux de travail le plus difficile pour plus tard. Croyez-moi, ce qui s'en vient changera complètement votre façon de travailler."

L'émergence de Sonnet 5.5 marque l'arrivée officielle de « l'ère de l'IA abordable et de haute qualité ».
Pour deux dollars américains, vous pouvez acheter « Baicai Infrastructure » avec un million de jetons.
La lecture du cache à un coût extrêmement faible (0,20 $/M) permet à chacun de créer facilement un assistant IA personnel avec une mémoire contextuelle ultra longue.
Êtes-vous prêt ? Si la nouvelle est vraie, nous aurons un nouveau modèle prêt à rouler dans moins de 24 heures.
Documents de référence :
https://x.com/notjazii/status/2103884749202993411
https://x.com/notjazii/status/2103884167104831573
https://x.com/chetaslua/status/2104153687077904613
https://x.com/chetaslua/status/2104259190432903599
https://x.com/Mr_Salio/status/2104210803545030792
https://x.com/Mr_Salio/status/2104178854633849145/
Commentaires