
Anthropic a présenté Claude Opus 5.5 : 30 % plus rapide et 40 % moins cher
Pour la plupart des tâches, Claude Opus 5.5 s’est rapprochée de la plus coûteuse Claude Fable 5.1, tandis que le coût d’exécution a diminué de 40 % par rapport à Opus 5 et que la vitesse de génération a augmenté de plus de 30 %.
Prix et vitesse
En API, Claude Opus 5.5 coûte $4 pour 1 million de tokens d’entrée et $20 pour 1 million de tokens de sortie. Les tarifs d’Opus 5 étaient respectivement de $5 et $25, ce qui signifie que le prix des tokens a diminué de 20 % et non de 40 %.
| Claude Opus 5.5 | Claude Opus 5 | |
|---|---|---|
| Jetons d’entrée | $4 pour 1 million | $5 pour 1 million |
| Jetons de sortie | $20 pour 1 million | $25 pour 1 million |
| Lecture du cache | $0,20 pour 1 million | $0,50 pour 1 million |
| Écriture dans le cache | $5 pour 1 million | $6,25 pour 1 million |
Les 40 % d’économie annoncés concernent le coût d’exécution de tâches typiques dans des paramètres standards. Anthropic explique cette différence par le fait que Opus 5.5 consomme moins de jetons par tâche et que la lecture du cache a vu son prix baisser de 60 %. Ce dernier point est particulièrement important pour Claude Code et les agents IA qui utilisent constamment un contexte précédemment sauvegardé.
Simultanément, le modèle génère des réponses plus de 30 % plus rapidement qu’Opus 5. Un mode Fast est également disponible pour Claude Code et la plateforme Claude, capable d’accélérer les performances jusqu’à 2,5 fois. Cela coûte deux fois plus cher : $8 pour 1 million de tokens d’entrée et $40 pour 1 million de tokens de sortie.
Performances
Selon des tests internes d’Anthropic, Opus 5.5 surpasse nettement Opus 5 en programmation, en utilisation de l’ordinateur et dans les tâches professionnelles. Dans Terminal-Bench 4.0, le modèle a obtenu 66,4 % contre 52,3 % pour Opus 5 et 55,8 % pour Fable 5.1. Le résultat de GPT-6 Astra s’établit à 57,9 %.
Dans GDPval-AA v2.1, qui évalue la réalisation de tâches professionnelles réelles issues de 44 spécialités, Opus 5.5 a obtenu 1846 points Elo. À titre de comparaison, Fable 5.1 a marqué 1735, Opus 5 – 1708, GPT-6 Astra – 1542, et GPT-5.6 Sol – 1588.
| Test | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 66,4 % | 55,8 % | 52,3 % | 57,9 % |
| GDPval-AA v2.1 | 1846 | 17 h 35 | 1708 | 1542 |
| AutomationBench | 40,0 % | 31,4 % | 26,9 % | 41,4 % |
| Humanity’s Last Exam avec des outils | 67,7 % | 65,6 % | 63,6 % | 57,2 % |
| Terminal-Bench-Science 0.1 | 58,7 % | 52,6 % | 29,0 % | 64,6 % |
| OSWorld 2.0 | 81,8 % | 80,7 % | 74,0 % | — |
Cependant, Opus 5.5 ne domine pas tous les tests. GPT-6 Astra a obtenu un score plus élevé sur AutomationBench et Terminal-Bench-Science. De plus, la plupart des résultats présentés proviennent directement d’Anthropic ; au moment de l’annonce, le résultat d’Opus 5.5 n’était pas encore disponible dans le tableau public Terminal-Bench 4.0. Par conséquent, il convient de considérer cette comparaison directe comme des données fournies par le fabricant, et non comme un test entièrement indépendant.
Anthropic mise spécifiquement sur les grandes tâches de programmation. L’un des premiers testeurs a utilisé Opus 5.5 pour vérifier et corriger une base de code de 200 000 lignes en moins de trois heures. Opus 5, sur la même tâche, a nécessité plus de 20 heures et environ 2,5 fois plus de jetons.
Sécurité et restrictions
Anthropic a également renforcé la protection du modèle lors de l’exécution autonome de code et d’outils. Selon une évaluation interne, Opus 5.5 a tenté environ 85 % moins souvent de dépasser les limites définies de l’environnement que Opus 5 et Mythos 5.1. Avant sa publication, le modèle a été testé par des organisations externes : Frontier Design et METR.

Des restrictions supplémentaires s’appliquent aux tâches les plus sensibles. En particulier, une grande partie des requêtes relatives à la cybersécurité peut être automatiquement redirigée vers Opus 4.8. Des mesures similaires sont utilisées pour les recherches biologiques et d’autres scénarios potentiellement dangereux.
Opus 5.5 utilise également le mécanisme de pensée préservée, qui empêche les clients API de modifier le contexte interne de raisonnement précédent du modèle. Pour les nouveaux comptes API, ce système sera en vigueur à partir du 31 août 2026. Il n’est pas possible de désactiver complètement le mode réflexion dans Opus 5.5.
Disponibilité
Claude Opus 5.5 est désormais disponible dans les services Anthropic, Claude Code et la plateforme Claude sous l’identifiant claude-opus-5-5, ainsi que via Amazon Web Services, Google Cloud et Microsoft Azure. L’entreprise a simultanément augmenté les limites d’utilisation de cinq heures pour les abonnements Pro, Max, Team et les licences d’entreprise.
Opus 5.5 est le premier modèle de la nouvelle génération. Anthropic prévoit de lancer Claude Sonnet 5.5 et Claude Haiku 5.5 dans les prochaines semaines, avec des améliorations similaires en matière de performances, d’efficacité et de sécurité.










