Anthropic a annoncé lundi la sortie de Claude Opus 4.5, le présentant comme son nouveau modèle d’IA phare. L’entreprise affirme que ce modèle est conçu pour gérer des tâches techniques complexes, les tâches de bureau quotidiennes et des travaux de recherche approfondis.
Sur son blog, l’entreprise a décrit le modèle comme étant « intelligent, efficace et le meilleur modèle au monde pour la programmation, les agents et l’utilisation d’un ordinateur ». Elle a également déclaré que cette mise à niveau marquait un changement important pour les « tâches quotidiennes comme la recherche approfondie et le travail avec des présentations et des feuilles de calcul ».
Il s’agit de la troisième sortie majeure de l’entreprise en deux mois, après Sonnet 4.5 et Haiku 4.5.
Premiers tests : « Il comprend tout simplement », affirme Anthropic
Au sein d’Anthropic, les testeurs internes ont systématiquement livré des retours positifs. L’entreprise a écrit que Claude Opus 4.5 « “comprend” tout simplement », soulignant sa capacité à gérer l’ambiguïté, à arbitrer entre différentes options et à diagnostiquer des bugs désordonnés comportant plusieurs volets, avec un minimum d’indications.
Anthropic a également soumis le modèle à un examen d’ingénierie particulièrement difficile, d’une durée de deux heures, normalement réservé aux candidats à l’embauche. Selon Anthropic, Opus 4.5 « a obtenu un meilleur score que n’importe quel candidat humain auparavant ». Le test porte exclusivement sur la résolution de problèmes techniques, et non sur les compétences relationnelles.
Ce résultat vient toutefois étayer l’argument de l’entreprise selon lequel l’IA avancée commence à rivaliser avec les ingénieurs experts, voire à les surpasser, dans certaines tâches précises.
Sur la quasi-totalité des principaux tests de programmation, Opus 4.5 atteint des scores de pointe. Sur SWE-Bench Verified, un jeu de données très suivi, le modèle est devenu le premier à dépasser 80 %, devançant de peu le Gemini 3 Pro de Google et le GPT-5.1 d’OpenAI dans certaines évaluations.
Le modèle est également proposé à un tarif réduit : 5 dollars US par million de jetons en entrée et 25 dollars US par million de jetons en sortie, une forte baisse par rapport aux précédents tarifs d’Opus, qui s’élevaient à 15 et 75 dollars US par million de jetons (entrée/sortie).
De nouveaux outils et de nouvelles intégrations
Anthropic associe également Opus 4.5 à une série de mises à jour de ses produits, conçues pour mettre en valeur les capacités améliorées du modèle en matière d’« utilisation d’un ordinateur ». Claude for Chrome est désormais déployé auprès de tous les abonnés Max, ce qui étend la portée du système dans le navigateur. Claude for Excel est également en cours d’extension et devient accessible aux clients Max, Team et Enterprise.
L’environnement de programmation de l’entreprise, Claude Code, introduit un « mode Plan » plus réfléchi et s’exécutera désormais directement dans l’application de bureau d’Anthropic, permettant aux utilisateurs de gérer plusieurs sessions de programmation simultanément.
À l’assaut du haut du classement
Cette sortie place clairement Anthropic face à Gemini 3 de Google et à GPT-5.1 d’OpenAI, tous trois ayant été lancés à quelques semaines d’intervalle. Contrairement à ses concurrents, Anthropic continue de mettre l’accent sur la productivité des entreprises plutôt que sur la génération de contenus créatifs, en concentrant ses points forts sur la programmation, les feuilles de calcul, la recherche et l’automatisation par agents.
Anthropic affirme qu’Opus 4.5 est désormais le modèle par défaut pour les clients Pro, Max et Enterprise. Avec des tarifs réduits, des intégrations étendues et une solide démonstration technique initiale, l’entreprise semble déterminée à consolider sa position d’IA de référence pour les entreprises et les activités d’ingénierie.
Ailleurs, GPT-5.1 Codex Max est présenté comme un modèle de programmation haut de gamme, offrant des cycles d’itération plus rapides et une intégration plus étroite avec l’espace de travail ChatGPT au sens large.

