Anthropic a officiellement publié la dernière version de son modèle phare d'intelligence artificielle - Opus 4.5. Il s'agit de la dernière version de la série Anthropic 4.5, après la sortie de Sonnet 4.5 en septembre de cette année et celle de Haiku 4.5 en octobre.

Opus 4.5 a obtenu de bons résultats dans plusieurs tests, notamment les tests de codage (SWE-Bench et Terminal-bench), l'utilisation des outils (tau2-bench et MCP Atlas) et les capacités générales de résolution de problèmes (ARC-AGI 2, GPQA Diamond). Il convient de noter que l'Opus 4.5 est devenu le premier modèle à obtenir un score supérieur à 80 % au test de codage faisant autorité, SWE-Bench Verified.
En plus des améliorations de performances, Anthropic a également souligné les nouvelles capacités d'Opus 4.5 en matière d'opérations informatiques et de traitement de tables, et a simultanément lancé une série de produits connexes pour vérifier l'efficacité du modèle dans des applications pratiques. Parallèlement à la sortie d'Opus 4.5, Claude pour Chrome et Claude pour Excel, deux produits qui étaient auparavant en phase pilote, seront mis à la disposition d'un plus large éventail d'utilisateurs. L'extension Chrome sera disponible pour tous les utilisateurs Max, tandis que la version Excel couvre les utilisateurs Max, équipe et entreprise.
La nouvelle version apporte également des améliorations significatives dans les tâches de texte long et de contexte long grâce à des optimisations majeures dans la façon dont la mémoire du modèle est gérée. Dianne Na Penn, responsable de la gestion des produits chez Anthropic, a déclaré : « Nous avons amélioré la qualité du contexte long, mais il ne suffit pas d'allonger la fenêtre contextuelle. La manière de mémoriser les détails clés est également cruciale. »
Ces mises à niveau permettent également de nouvelles fonctionnalités que de nombreux utilisateurs réclamaient depuis longtemps, comme un mode « conversations illimitées » pour les utilisateurs payants de Claude. Cette fonctionnalité permet au modèle de compresser automatiquement la mémoire lorsque la fenêtre contextuelle atteint sa limite supérieure, sans interrompre le flux de discussion ni inviter l'utilisateur.
Une partie de la mise à niveau se concentre sur des scénarios de cas d'utilisation d'agents, en particulier lorsqu'Opus est utilisé comme modèle principal pour commander des sous-agents pilotés par Haiku. De telles tâches reposent sur une mémoire de travail importante, et l'optimisation de la mémoire de l'Opus 4.5 est particulièrement précieuse dans de tels scénarios. Penn a déclaré : « La mémoire est la base. Claude doit non seulement être capable d'explorer la base de code et les documents volumineux, mais il doit également savoir quand revenir en arrière et réviser.
L'Opus 4.5 sera confronté à une concurrence féroce de la part d'autres modèles de pointe sur le marché, notamment GPT 5.1 lancé par OpenAI le 12 novembre et Gemini 3 lancé par Google le 18 novembre.