Claude Opus 5.5 est le nouveau modèle phare d’Anthropic, annoncé le 22 septembre 2026. Premier-né de la famille Claude 5.5, il promet des performances proches du très haut de gamme Claude Fable 5.1 pour un coût d’exploitation inférieur d’environ 40 % à son prédécesseur direct, Opus 5. Prix, benchmarks vérifiés, comparatif face à GPT-6 Astra et aux autres flagships : voici l’analyse complète.
Annonce et contexte
Anthropic a dévoilé Claude Opus 5.5 le 22 septembre 2026 via son annonce officielle « Introducing Claude Opus 5.5 ». Le modèle était disponible immédiatement sur la plateforme Claude, l’API, ainsi que sur AWS, Google Cloud et Microsoft Azure.
Le timing n’est pas anodin. Opus 5.5 arrive :
- trois semaines après le lancement du flagship d’OpenAI, GPT-6 Astra (3 septembre 2026), positionné comme « le modèle le plus intelligent et le plus aligné au monde » par OpenAI ;
- le même jour que les GPT-6 Sol et Luna d’OpenAI, deux déclinaisons économiques de la famille GPT-6 (environ 50 % moins chères que GPT-5.6) ;
- trois semaines après les propres modèles haut de gamme d’Anthropic, Claude Fable 5.1 et Mythos 5.1 (1er septembre 2026).
La promesse officielle est claire : là où les lancements précédents empilaient la puissance, Opus 5.5 joue la carte de l’efficacité — plus rapide (+30 % de vitesse de génération selon Anthropic), moins cher (-20 % par token, -60 % sur les lectures de cache), et des performances qui talonnent Fable 5.1 sur le code agentique et le travail de connaissance. C’est aussi le premier lancement d’Anthropic depuis l’appel de Dario Amodei à « ralentir la frontière » (pace the frontier) : la sécurité et l’alignement occupent une place inhabituellement centrale dans l’annonce.
Essayer Claude Opus 5.5
Lien officiel
Fiche technique
| Caractéristique | Valeur |
|---|---|
| Éditeur | Anthropic |
| Date d’annonce | 22/09/2026 |
| Disponibilité | Immédiate : API Claude, Claude.ai, AWS, Google Cloud, Microsoft Azure |
| Famille | Claude 5.5 (premier modèle de la famille) |
| Type | Modèle de raisonnement, optimisé pour le code agentique et le travail de connaissance |
| Fenêtre de contexte (entrée) | 1 000 000 tokens |
| Tokens max en sortie | 128 000 (300 000 en traitement batch) |
| Cutoff des connaissances | Juin 2026 (selon la presse tech) |
| Identifiant API | claude-opus-5-5 |
| Mode rapide | Oui : jusqu’à 2,5× plus rapide, au double du tarif |
| Rétention des données | Option « Zero Data Retention » disponible |
| Filigrane (EU AI Act) | Inclus selon la presse tech |
| Architecture / nombre de paramètres | Non communiqué |
Nouveautés par rapport à Opus 5
| Critère | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Prix entrée / million de tokens | 4 $ | 5 $ |
| Prix sortie / million de tokens | 20 $ | 25 $ |
| Lecture de cache / million | 0,20 $ (-60 %) | 0,50 $ |
| Écriture de cache / million | 5 $ | 6,25 $ |
| Vitesse de génération | +30 % | Référence |
| Coût typique par tâche | -40 % (selon Anthropic) | Référence |
| Terminal-Bench 4.0 (code agentique) | 66,4 % | 52,3 % |
| Mode rapide | Oui (8 $ / 40 $, jusqu’à 2,5× plus rapide) | Non communiqué |
| Raisonnement désactivable | Non (le « thinking » est toujours actif et facturé en sortie) | Non communiqué |
| Évaluateurs externes pré-lancement | Frontier Design, METR | Non communiqué |
Le saut le plus spectaculaire concerne le code agentique : +14 points sur Terminal-Bench 4.0. Mais la vraie nouveauté économique est ailleurs : Anthropic insiste sur le coût par tâche accomplie plutôt que sur le prix facial du token. Le modèle consommerait moins de tokens et moins d’étapes par tâche — GitHub rapporte par exemple qu’Opus 5.5 résout plus de tâches de terminal dans VS Code qu’Opus 5 en deux fois moins d’étapes.
Point de vigilance honnête, soulevé par Anthropic elle-même : à ce niveau de capacité, « les écarts de benchmarks sont un guide moins fiable des différences réelles ». L’écart affiché avec Fable 5.1 serait ainsi plus faible en usage réel que sur le papier.
Benchmarks
Scores publiés par Anthropic le 22/09/2026 (chiffres constructeur), complétés par des mesures indépendantes.
| Benchmark | Claude Opus 5.5 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 (code agentique) | 66,4 % | 52,3 % | 55,8 % |
| CursorBench 4.0 | 57,8 % | 46,6 % | 51,8 % |
| FrontierCode v1.1 (Main) | 54,4 % | 48,0 % | 50,3 % |
| GDPval-AA v2.1 (travail pro, 44 métiers) | 1 846 Elo | 1 708 Elo | 1 735 Elo |
| AutomationBench | 40,0 % | 26,9 % | 31,4 % (runs Zapier) |
| Terminal-Bench-Science 0.1 | 58,7 % | 29,0 % | 52,6 % |
| OSWorld 2.1 (utilisation d’ordinateur) | 81,8 % | 74,0 % | 80,7 % |
| Humanity’s Last Exam (avec outils) | 67,7 % | 63,6 % | 65,6 % |
Mesures indépendantes : Artificial Analysis attribue à Opus 5.5 un score de 58 à son Intelligence Index v4.3 (raisonnement maximal), soit 7 points de plus qu’Opus 5 ; le modèle arrive en tête sur 6 des 10 évaluations de l’index (Humanity’s Last Exam : 61,4 %, SciCode : 66,9 %). L’évaluation pondérée de Vals AI le classe également premier tous modèles confondus (69,69 %).
Absent notable : aucun score SWE-bench Verified ne figure dans la communication d’Anthropic — une première pour un lancement flagship, alors que ce benchmark structurait les annonces des deux dernières années. La sécurité, elle, est chiffrée par des évaluateurs externes : -85 % de tentatives de contournement des barrières selon Frontier Design et METR. Anthropic admet toutefois que le modèle « soupçonne souvent qu’on l’évalue », ce qui fragilise la portée de ces tests.
Sources du tableau : annonce Anthropic du 22/09/2026 (reprise par la presse tech) ; GDPval-AA v2.1 = évaluations indépendantes d’Artificial Analysis ; AutomationBench Fable 5.1 (31,4 %) = runs Zapier ; scores Astra = page d’annonce OpenAI du 03/09/2026, TB-Science actualisé à 68,1 % le 29/09/2026 (OSWorld Astra : 73,5 % dans les charts du 22/09) ; Artificial Analysis via FrontierNews ; Vals AI.
Comparatif : Opus 5.5 face aux modèles concurrents
| Modèle | Éditeur | Prix API entrée / sortie (par million) | Contexte | Positionnement documenté |
|---|---|---|---|---|
| Claude Opus 5.5 | Anthropic | 4 $ / 20 $ | 1 M | Meilleur rapport performance/prix du moment selon Anthropic |
| Claude Fable 5.1 | Anthropic | 10 $ / 50 $ | 1 M | Haut de gamme Anthropic (lancé le 01/09/2026) |
| GPT-6 Astra | OpenAI | 10 $ / 50 $ | 1,05 M | Flagship OpenAI ; computer use, cybersécurité (niveau « Critical ») |
| Gemini 3.1 Pro Preview | 2 $ / 12 $ | 1 M | Flagship propriétaire le moins cher ; raisonnement profond | |
| Grok 4.7 | xAI | 2 $ / 6 $ | 500 K | Tarifs agressifs ; données de benchmarks limitées dans les sources consultées |
| MiMo-V2.6-Pro | Xiaomi | 0,43 $ / 0,87 $ | Non communiqué | Meilleur modèle open-weights (Artificial Analysis : 46 à l’Intelligence Index) |
Face-à-face documenté Opus 5.5 vs GPT-6 Astra (chiffres Anthropic, sauf mention) :
| Benchmark | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|
| Terminal-Bench 4.0 | 66,4 % | 57,9 % |
| OSWorld 2.1 | 81,8 % | 72,6 % (officiel OpenAI) |
| Humanity’s Last Exam (avec outils) | 67,7 % | 57,2 % (officiel OpenAI) |
| Terminal-Bench-Science 0.1 | 58,7 % | 68,1 % |
| FrontierCode v1.1 (Main) | 54,4 % | 53,3 % (officiel OpenAI) |
| Prix entrée / sortie | 4 $ / 20 $ | 10 $ / 50 $ |
Opus 5.5 domine son rival direct sur le code agentique et l’utilisation d’ordinateur, pour un tarif 2,5 fois inférieur. GPT-6 Astra reprend l’avantage sur le benchmark scientifique et conserve une longueur d’avance produit sur le computer use grand public. Face à Gemini 3.1 Pro, le flagship de Google reste imbattable sur le prix facial (2 $ / 12 $), mais sans le niveau de preuve apporté par Anthropic sur les tâches agentiques longues.
Cas d’usage
- Développement logiciel agentique : le terrain de jeu naturel d’Opus 5.5 — migrations de code massives (680 000 lignes migrées en moins d’une journée lors des tests), audits de code (200 000 lignes auditées en moins de 3 h contre 20 h pour Opus 5).
- Agents autonomes longue durée : un testeur rapporte un agent resté « sur sa tâche pendant plus de 18 heures » sur un dépôt ; la fenêtre de 1 M de tokens et le cache à 0,20 $ en font un candidat économique.
- Travail de connaissance professionnelle : 1 846 Elo à GDPval-AA v2.1 (44 métiers) — recherche, synthèse documentaire, analyse.
- Utilisation d’ordinateur : 81,8 % à OSWorld 2.1 — automatisation d’applications, formulaires, tableurs.
- Prototypage rapide via Claude Code : le mode rapide (jusqu’à 2,5× plus véloce) y est disponible nativement.
- Organisations régulées : option Zero Data Retention et filigrane conforme à l’EU AI Act.
Tarifs et accès
| Offre | Entrée / 1 M | Sortie / 1 M | Cache | Notes |
|---|---|---|---|---|
| Standard | 4 $ | 20 $ | Lecture 0,20 $ · écriture 5 $ | -20 % vs Opus 5 sur tous les postes, -60 % sur la lecture de cache |
| Mode rapide | 8 $ | 40 $ | Non communiqué | Jusqu’à 2,5× plus rapide ; via Claude Code et la plateforme Claude |
| Batch | 2 $ | 10 $ | — | Sortie jusqu’à 300 000 tokens |
Accès : API Anthropic, application Claude, Amazon Web Services, Google Cloud, Microsoft Azure. Les tarifs d’abonnement grand public (formules Claude Pro/Max) n’ont pas été retrouvés dans les sources consultées au 27/09/2026 : non communiqué.
Voir les tarifs de Claude Opus 5.5
Lien officiel
FAQ
Quand Claude Opus 5.5 est-il sorti ?
Le 22 septembre 2026. C’est le premier modèle de la nouvelle famille Claude 5.5 d’Anthropic, disponible immédiatement via l’API, Claude.ai, AWS, Google Cloud et Azure.
Combien coûte Claude Opus 5.5 ?
4 $ par million de tokens en entrée et 20 $ en sortie, soit 20 % de moins qu’Opus 5. La lecture de cache coûte 0,20 $ par million (-60 %). Un mode rapide existe à 8 $ / 40 $. Les tarifs d’abonnement grand public n’ont pas été communiqués dans les sources consultées.
Claude Opus 5.5 est-il gratuit ?
Non communiqué. Anthropic n’a pas annoncé d’accès gratuit spécifique à Opus 5.5 dans les sources consultées au 27/09/2026 ; l’accès se fait via l’API payante et les plateformes cloud.
Quelle est la différence entre Claude Opus 5.5 et Opus 5 ?
Opus 5.5 est 20 % moins cher par token, génère 30 % plus vite, et progresse fortement sur le code agentique (66,4 % vs 52,3 % à Terminal-Bench 4.0). Anthropic estime le coût par tâche typique inférieur d’environ 40 %.
Claude Opus 5.5 ou GPT-6 Astra : lequel choisir ?
Pour le code agentique et l’utilisation d’ordinateur au meilleur coût, Opus 5.5 mène (66,4 % vs 57,9 % à Terminal-Bench 4.0) pour un tarif 2,5 fois inférieur. GPT-6 Astra garde l’avantage sur les benchmarks scientifiques (Terminal-Bench-Science : 68,1 % vs 58,7 %) et le computer use grand public.
Comment accéder à Claude Opus 5.5 ?
Via l’API Anthropic (identifiant claude-opus-5-5), l’application Claude, ou les marketplaces AWS, Google Cloud et Microsoft Azure. Une option Zero Data Retention existe pour les usages sensibles.
Quelles sont les limites connues d’Opus 5.5 ?
Le mode de raisonnement (« thinking ») ne peut pas être désactivé et ses tokens sont facturés en sortie. Les tâches de cybersécurité avancées sont redirigées vers Opus 4.8 et la biologie est soumise à un programme de vérification. Anthropic reconnaît que le modèle détecte souvent les situations d’évaluation.
Verdict
Opus 5.5 est le lancement le plus rationnel de l’année : pas de course à la puissance brute, mais une efficacité mesurable — 40 % de coût en moins par tâche, 30 % de vitesse en plus, et des scores de code agentique qui dépassent même le très haut de gamme Fable 5.1. À 4 $ / 20 $ le million de tokens, il redéfinit le standard du rapport performance/prix chez les modèles propriétaires.
Choisissez-le si : vous faites du développement agentique, des audits de code, des agents longue durée ou du travail de connaissance intensif.
Passez votre chemin si : vous cherchez le maximum absolu de capacité généraliste (Fable 5.1 reste le haut de gamme), du computer use grand public (GPT-6 Astra), ou le prix plancher (les modèles open-weights comme MiMo-V2.6-Pro coûtent 10 fois moins cher).
Note de la rédaction : 8,5/10 — la référence actuelle du code agentique, avec un bémol sur l’absence de score SWE-bench publié et un raisonnement non désactivable.
Découvrir Claude Opus 5.5
Lien officiel