Anthropic a mis en ligne le 22 septembre 2026 Claude Opus 5.5, premier modèle de la famille 5.5. L’annonce insiste moins sur un score record que sur le coût par tâche : à qualité comparable à Fable 5.1 sur la majorité des usages, Opus 5.5 réduit la facture de 40 % sur des charges de travail agentiques typiques, avec une génération plus de 30 % plus rapide.
Une tarification API revue à la baisse
Le tarif API passe de 5 $ / 25 $ (entrée / sortie, par million de tokens) sous Opus 5 à 4 $ / 20 $ sous Opus 5.5, soit une baisse de 20 % sur les deux bornes. La lecture de cache descend de 0,50 $ à 0,20 $ par million de tokens, une réduction de 60 % qui pèse directement sur les architectures d’agents à contexte long et appels répétés. Un mode rapide (« fast mode ») est proposé à 8 $ / 40 $ le million de tokens, avec un gain de vitesse de 2,5x pour les usages sensibles à la latence.
| Poste | Opus 5 | Opus 5.5 | Variation |
|---|---|---|---|
| Entrée (par M tokens) | 5 $ | 4 $ | -20 % |
| Sortie (par M tokens) | 25 $ | 20 $ | -20 % |
| Lecture de cache (par M tokens) | 0,50 $ | 0,20 $ | -60 % |
| Coût typique sur charge agentique | référence | -40 % | -40 % |
Des gains concentrés sur le code et les tâches longues
Les benchmarks publiés par Anthropic montrent une progression nette sur les tâches orientées développement : Terminal-Bench 4.0 passe de 52,3 % à 66,4 %, FrontierCode v1.1 de 48,0 % à 54,4 %, et CursorBench 4.0 de 46,6 % à 57,8 %. Sur OSWorld 2.0, qui évalue l’usage d’un ordinateur complet, le score grimpe de 74,0 % à 81,8 %.
Sur des cas concrets rapportés par Anthropic, un testeur a mené une migration de 680 000 lignes de code en moins d’une journée, et un portage d’un proxy HAProxy legacy de C vers Rust a pris 9,5 heures contre 12 heures avec Fable 5.1, soit un gain de 51 %. Un audit de code de 200 000 lignes, qui demandait auparavant plus de 20 heures, se boucle désormais en moins de trois heures.
À qualité comparable à Fable 5.1 sur la majorité des tâches, Opus 5.5 réduit de 40 % le coût typique des charges de travail agentiques tout en générant plus de 30 % plus vite.
Intégration côté agents et outils
Anthropic met en avant une réduction du nombre d’appels d’outils et d’étapes par tâche, avec pour conséquence directe une baisse de coût sur les architectures d’agents — un enjeu déjà documenté par Mail Studio à propos des agents éditoriaux en production. GitHub, cité dans l’annonce, rapporte des tâches en moitié moins d’étapes. Le modèle délègue aussi mieux à des sous-agents, ce qui rapproche les usages agentiques de la logique d’interopérabilité du protocole MCP.
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5-5",
max_tokens=4096,
messages=[{"role": "user", "content": "Audite ce module et liste les régressions probables."}],
)
print(response.content[0].text)Le mode réflexion (« thinking ») ne peut plus être désactivé sur Opus 5.5, à la différence des versions précédentes. Les intégrations qui reposaient sur un mode sans réflexion pour réduire la latence devront recalibrer leurs délais d’attente et leur gestion du flux de sortie avant bascule en production.
Disponibilité
Le modèle est accessible via l’API Claude ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure, sous l’identifiant claude-opus-5-5. Anthropic précise avoir fait évaluer le modèle par des organismes externes, dont METR et Frontier Design, avant sa mise en service. Le dossier complet des usages professionnels de l’IA côté développement est suivi dans le guide IA pour les développeurs de Mail Studio.
Ce qu’il faut retenir
Opus 5.5 ne cherche pas à battre les scores bruts des générations précédentes à tout prix, mais à réduire le coût et le temps nécessaires pour obtenir un résultat équivalent, en particulier sur les tâches de code et les flux agentiques longs. La baisse de tarification API accompagne ce positionnement et rend l’usage en production plus soutenable pour les équipes qui enchaînent de nombreux appels.
Ce que je retiens surtout de cette annonce, c’est le déplacement du curseur marketing : depuis deux ans les labos communiquaient sur les scores de benchmark, Anthropic communique ici sur le coût par tâche réellement accomplie. C’est le bon indicateur pour qui déploie des agents en production, et c’est plus difficile à survendre qu’un chiffre de leaderboard. Reste à vérifier sur mes propres charges de travail si le ratio qualité/coût tient sur la durée, pas seulement sur les cas de démonstration — Simon Janvier.
Pour aller plus loin : l’annonce complète est disponible sur anthropic.com/news.
