Claude Opus 5.5 en détail : paramètres, tarifs et place dans le paysage
D’après des sources vérifiées sur Claude Opus 5.5 : paramètres publiés, prix catalogue de $4/$20, lecture des benchmarks face à Fable 5.1, Opus 5 et GPT-6 Astra, et groupes publics Modelflare ouverts le 30 septembre 2026, claude-award, claude-stable et claude-premium.
Claude Opus 5.5 a été publié le 22 septembre 2026. Le contrat public est écrit sur la page du modèle et dans les nouveautés : l’ID d’API est claude-opus-5-5, le contexte est de 1M tokens, la sortie maximale de 128K, la réflexion adaptative reste activée, l’effort par défaut est medium, et le prix catalogue est de $4 par million de tokens d’entrée et de $20 par million de tokens de sortie. Ces pages d’Anthropic ne donnent ni un nombre de paramètres ni une puissance de calcul d’entraînement. Cet article n’utilise que la spécification déjà publiée, le tableau de prix publié et le tableau de benchmarks publié.
Conclusion après vérification : au prix catalogue du site d’Anthropic, Opus 5.5 est le palier Opus actuel. Au token, il est moins cher qu’Opus 5, et beaucoup moins cher que Fable 5.1. Sur les lignes de programmation et de travail de connaissance imprimées par Anthropic, ses scores devancent Fable 5.1 et Opus 5, et sur la plupart de ces lignes ils devancent aussi GPT-6 Astra. Deux lignes vont dans l’autre sens : Astra mène Terminal-Bench-Science 0.1 et l’AutomationBench de Zapier. L’interface de tarifs de Modelflare contenait déjà claude-opus-5-5 le 30 septembre 2026, et les prix unitaires correspondent aux $4 / $20 officiels. Les groupes publics ouverts sur cette ligne sont claude-award 0.25, claude-stable 0.315 et claude-premium 0.5. Une clé de ce palier doit envoyer claude-opus-5-5. Les tarifs en direct sont sur la page des tarifs.
Le comportement officiel ci-dessous est cité depuis la page du modèle Opus 5.5, les nouveautés et la page de lancement. Les détails de migration de Fable 5.1 figurent dans l’évaluation de Fable 5.1 déjà présente sur ce blog.
Paramètres déjà publiés
| Élément | Claude Opus 5.5 |
|---|---|
| ID du modèle, Claude API | claude-opus-5-5 |
| ID Amazon Bedrock | anthropic.claude-opus-5-5 |
| ID Google Cloud et Microsoft Foundry | claude-opus-5-5 |
| Date de publication | 22 septembre 2026 |
| Fenêtre de contexte | 1M tokens, la valeur par défaut est déjà le maximum |
| Sortie maximale | 128K tokens |
| Réflexion | Adaptative, toujours active |
| Effort par défaut | medium |
| Classe de latence sur la page du modèle | Modérée |
| Coupure fiable des connaissances | juin 2026 |
| Nombre de paramètres | Non fourni sur la page publique du modèle |
« Coupure fiable des connaissances » est le nom qu’Anthropic donne à la date jusqu’à laquelle les connaissances déjà acquises du modèle sont les plus étendues. C’est distinct de la fenêtre de contexte. Un fichier joint à la requête reste dans ce contexte.
Le fast mode est un commutateur de vitesse sur le même ID de modèle. La documentation le marque comme une préversion de recherche disponible seulement sur la Claude API. La requête utilise speed: "fast" avec l’en-tête bêta fast-mode-2026-02-01. Anthropic tarifie ce mode à $8 / $40 par million de tokens et écrit la vitesse de sortie comme jusqu’à environ 2.5×. Les nouveautés précisent qu’Amazon Bedrock, Claude Platform on AWS, Google Cloud et Microsoft Foundry n’ont pas ce fast mode.
La même page écrit l’échelle d’effort comme le réglage de la profondeur de réflexion : low, medium, high, xhigh et max. Un budget de réflexion fixé à la main est refusé. La longueur minimale d’un prompt pouvant être mis en cache est de 512 tokens.
Tarifs
Prix catalogue officiels
L’unité est le dollar des États-Unis par million de tokens. Le cache, le traitement par lot et le fast mode d’Opus 5.5 viennent de la section des prix des nouveautés. La cellule d’écriture de cache d’Opus 5 est le seul chiffre « cache writes » du tableau de comparaison de la page de lancement ; ce tableau ne sépare pas les paliers de 5 minutes et d’une heure. La lecture de cache de Fable 5.1 reprend le chiffre officiel déjà utilisé dans l’évaluation de Fable 5.1 de ce blog. Les prix d’entrée et de sortie de Sonnet 5 et de Haiku 4.5 viennent de la ligne de comparaison sur la page du modèle Opus 5.5. Un tiret signifie que cet article n’a pas pris cette cellule dans une ligne de prix de première main.
| Prix par 1M de tokens | Opus 5.5 | Opus 5 | Fable 5.1 | Sonnet 5 | Haiku 4.5 |
|---|---|---|---|---|---|
| Entrée | $4 | $5 | $10 | $2 | $1 |
| Sortie | $20 | $25 | $50 | $10 | $5 |
| Lecture de cache | $0.20 | $0.50 | $0.25 | — | — |
| Écriture de cache | 5 minutes $5 ; 1 heure $8 | $6.25 | — | — | — |
| Entrée / sortie en lot | $2 / $10 | — | — | — | — |
| Entrée / sortie du fast mode | $8 / $40 | — | — | — | — |
Par rapport à Opus 5, le prix catalogue de l’entrée et de la sortie fraîches baisse de 20%, de $5 / $25 à $4 / $20. La lecture de cache, qui pèse davantage dans les longues boucles d’agent, passe de $0.50 à $0.20. C’est 60% de moins que le prix de lecture de cache d’Opus 5, et c’est aussi en dessous des $0.25 de Fable 5.1. Anthropic avance en plus une affirmation sur la charge de travail : avec les réglages par défaut, les tâches typiques coûtent environ 40% de moins qu’avec Opus 5, parce que le modèle consomme aussi moins de tokens. Ces 40% décrivent leur propre banc d’essai. La facture réelle dépend encore de l’effort, du taux de hits du cache et des tours d’outils.
Le traitement par lot vaut la moitié du nouveau prix catalogue. Le fast mode vaut le double du nouveau prix catalogue, et seulement sur la Claude API.
Catalogue Modelflare du 30 septembre 2026
Le GET https://modelflare.dev/api/pricing lu le 30 septembre 2026 contient claude-opus-5-5. La même réponse contient aussi claude-opus-5, claude-fable-5-1, claude-sonnet-5, claude-sonnet-5-5, claude-haiku-4-5, gpt-6-astra et gpt-5.6-sol. Elle ne contient pas d’ID Haiku 5.5.
Les prix unitaires du tableau ci-dessous sont les prix au token de cette réponse, avant multiplication par le facteur de groupe. Les lignes Claude correspondent au prix catalogue officiel. Astra et Sol sont échelonnés : quand le contexte d’entrée dépasse 272,000 tokens, c’est la deuxième paire de prix qui s’applique, et le prix de sortie du long contexte est le prix de sortie propre à ce palier. Dans la colonne d’exemple, les lignes Claude sont multipliées par claude-stable 0.315 et les lignes OpenAI par openai-stable 0.08. Les facteurs Claude de cette lecture sont claude-premium 0.5, claude-stable 0.315 et claude-award 0.25. Les facteurs OpenAI sont openai-premium 0.13, openai-stable 0.08 et openai-award 0.03. Opus 5.5 n’active que les trois groupes Claude ci-dessus. claude-tmp-cheap est un groupe Claude public, et cette ligne ne l’active pas.
| Modèle | ID du catalogue | Entrée / sortie unitaires | Prix utilisateur sur le groupe stable |
|---|---|---|---|
| Opus 5.5 | claude-opus-5-5 |
$4 / $20 | $1.26 / $6.30 |
| Opus 5 | claude-opus-5 |
$5 / $25 | $1.575 / $7.875 |
| Fable 5.1 | claude-fable-5-1 |
$10 / $50 | $3.15 / $15.75 |
| Sonnet 5 | claude-sonnet-5 |
$2 / $10 | $0.63 / $3.15 |
| GPT-6 Astra | gpt-6-astra |
$10 / $50, puis $20 / $75 | $0.80 / $4.00, puis $1.60 / $6.00 |
| GPT-5.6 Sol | gpt-5.6-sol |
$5 / $30, puis $10 / $45 | $0.40 / $2.40, puis $0.80 / $3.60 |
Opus 5.5 sur claude-stable vaut $4 × 0.315 et $20 × 0.315. Pour comparer Opus 5.5 aux autres laboratoires, regardez le tableau officiel. Pour lire une facture Modelflare que l’on peut envoyer aujourd’hui, regardez le tableau du catalogue.
Haiku 4.5 est aussi dans le même catalogue, au prix unitaire $1 / $5. Sur claude-stable, cela fait $0.315 / $1.575. La comparaison de la page du modèle donne toujours à Haiku un contexte de 200K et une sortie maximale de 64K. La réponse du 30 septembre 2026 ne contient pas Haiku 5.5. Haiku 4.5 reste le bas de gamme de la ligne Claude qui est effectivement listé.
Les facteurs de cache des lignes du catalogue sont une fraction du prix unitaire d’entrée : 0.05 pour Opus 5.5, donc la lecture de cache du catalogue est de $0.20 et l’écriture de cache du catalogue est de $5. Ce prix d’écriture correspond au palier officiel de 5 minutes. L’écriture officielle d’une heure est de $8, et le catalogue n’a pas ce palier séparément. Opus 5 et Sonnet 5 sont à 0.1, Fable 5.1 à 0.025. Le cache, le long contexte et les paliers de priorité se règlent d’après la page des tarifs et d’après l’enregistrement d’usage une fois terminé.
Ce qui a changé par rapport à Opus 5 et à Fable 5.1
| Comportement | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| ID d’API | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
| Contexte / sortie maximale | 1M / 128K | 1M / 128K | 1M / 128K |
| Réflexion | Toujours active. disabled et un budget manuel renvoient 400 |
Active par défaut. disabled n’est accepté que si l’effort vaut high ou moins |
Toujours active |
| Effort par défaut quand le champ est omis | medium |
high |
high |
| Coupure fiable des connaissances | juin 2026 | mai 2026 | juin 2026 |
| Prix catalogue entrée / sortie | $4 / $20 | $5 / $25 | $10 / $50 |
| Lecture de cache | $0.20 | $0.50 | $0.25 |
| Choix d’outil forcé | any et tool renvoient 400 |
Listé comme changement incompatible par rapport à Opus 5 | Le même 400 qu’Opus 5.5 |
| Protection de cybersécurité | Confie la tâche à Opus 4.8 | Les notes de publication ne placent pas ce repli sur Opus 5 | Protection de niveau Fable |
| Protection biologie et LLM de frontière | Confie la tâche à Opus 5 | Les notes de publication écrivent ce repli avec Opus 5.5 | La même classe de protection |
Opus 5.5 peut lire les blocs de réflexion produits par Opus 5 ainsi que par les Opus, Sonnet et Haiku antérieurs. Il ne lit pas les blocs de réflexion produits par Fable ou Mythos. Sur la Claude API, Fable 5.1 et Mythos 5.1 peuvent lire les blocs de réflexion d’Opus 5.5 ; les nouveautés précisent qu’aucun autre modèle actuel ne le peut. Un bloc que le modèle cible ne peut pas lire est écarté avant que le modèle le voie, et un bloc écarté n’est pas facturé.
Les comptes créés le 31 août 2026 ou après subissent un contrôle plus strict : si le prompt système, la liste d’outils ou un message antérieur a changé après la production d’un bloc de réflexion d’Opus 5.5, rejouer ce bloc renvoie 400. La méthode indiquée par le guide de migration est un historique en ajout seul ; quand les instructions doivent changer, utilisez un message système au milieu de la conversation. La page de lancement écrit aussi qu’Opus 5.5 embarque le contrôle de réflexion préservée introduit par Fable 5.1, le filigrane du règlement européen sur l’IA, et une rétention nulle des données alignée sur les Opus précédents.
Comment lire les scores d’intelligence
Le tableau ci-dessous est exactement celui imprimé sur la page de lancement. Anthropic dit que, sauf indication contraire dans une note, Opus 5.5 utilise la réflexion adaptative avec un effort max. Terminal-Bench 4.0 est cette note : Opus 5.5 en xhigh, GPT-6 Astra en high, chacun au score publié le plus élevé de ce modèle. Les chiffres d’Astra et de Sol sont cités d’après le rapport d’OpenAI. Les protections de production sont activées. Quand elles interviennent, les tâches de cybersécurité sont réalisées par Opus 4.8, et les tâches de biologie et de développement de LLM de frontière par Opus 5. Anthropic dit que cela tire les scores d’Opus 5.5 vers le bas.
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| FrontierCode v1.1 (Main) | 54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% | — | 41.7% |
| GDPval-AA v2.1 | 1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench | 40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| Humanity's Last Exam, avec outils | 67.7% | 65.6% | 63.6% | 57.2% | — |
| Terminal-Bench-Science 0.1 | 58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| OSWorld 2.0, partial | 81.8% | 80.7% | 74.0% | — | — |
| Chartography, avec outils | 89.0% | 88.4% | 83.4% | — | — |
Mettez les écarts à côté des marges d’erreur qu’ils ont publiées. Sur Terminal-Bench 4.0, Opus 5.5 est à ±2.6 points et les autres modèles Claude de ±1.6 à ±2 points. De 66.4% aux 57.9% d’Astra et aux 55.8% de Fable, les deux écarts sont plus larges que ces marges. Terminal-Bench-Science est de ±3.5 à ±5 points par modèle. Les 64.6% d’Astra face aux 58.7% d’Opus 5.5 ont une ampleur proche de la largeur de ces marges, et sur l’estimation ponctuelle Astra est devant.
AutomationBench a été exécuté par Zapier. Comme cette exécution n’avait pas de modèle de repli, les interventions des protections ont compté comme des échecs. Anthropic dit que le score réel serait plus élevé. Les 40.0% imprimés face aux 41.4% d’Astra sont un résultat publié très proche, et sur l’estimation ponctuelle Astra est devant. GDPval-AA v2.1 est un Elo de tâches professionnelles réelles couvrant 44 métiers : Opus 5.5 à 1846, Fable 5.1 à 1735, Opus 5 à 1708, Sol à 1588, Astra à 1542.
Les graphiques de coût de la même page de lancement portent un second groupe de scores, pris à l’effort par défaut medium : FrontierCode 54.6%, CursorBench 52.5%. Le tableau de comparaison imprime 54.4% et 57.8%. Tenez-les pour deux chiffres d’Anthropic sous deux réglages d’effort. La légende dit aussi qu’à l’effort medium, FrontierCode dépasse le meilleur score d’Astra, 53.3%, pour environ un cinquième du coût par tâche, et que Terminal-Bench fait jeu égal avec Astra pour environ 40% du coût. Ce sont des affirmations de coût par tâche au sujet du banc d’essai propre d’Anthropic.
La phrase sous le tableau est plutôt celle qu’il faut garder : dans l’usage propre d’Anthropic, l’écart entre Opus 5.5 et Fable 5.1 paraît plus étroit que les scores, et les écarts de benchmark à ce niveau guident plus faiblement une tâche réelle. Les citations de clients sur la page de lancement sont des témoignages choisis. Elles peuvent indiquer quoi rejouer, et elles n’appartiennent pas au tableau des scores.
Où il se place dans le paysage actuel des modèles
Trois changements vérifiables sont arrivés le même jour.
Le type de travail qu’Anthropic décrit comme « au niveau de Fable 5.1 pour la plupart des tâches » a maintenant une grille de prix Opus. Le prix catalogue est de $4 / $20, Fable 5.1 est à $10 / $50. La lecture de cache est à $0.20, Fable à $0.25 et Opus 5 à $0.50. Si le rejeu propre d’une équipe confirme ce jugement, Fable 5.1 reste réservé aux tâches qui échouent encore, et la boucle elle-même passe à Opus 5.5. Si le rejeu ne le confirme pas, le tableau a déjà écrit les exceptions publiées : les tâches d’agent scientifique et les flux métier de Zapier, où Astra mène les chiffres imprimés.
La valeur par défaut a bougé en même temps que le prix. La configuration des modèles de Claude Code, mise à jour en même temps que cette publication, fait d’Opus 5.5 le modèle par défaut de Pro, Max, Team, Enterprise et de l’API Anthropic, et aussi le modèle par défaut de Claude Platform on AWS, d’Amazon Bedrock et de Google Cloud Agent Platform. Une valeur par défaut dans le produit d’agent entraîne plus de trafic qu’une ligne de plus dans le sélecteur de modèles.
La frontière des protections est descendue jusqu’à Opus. Les Opus antérieurs prenaient le trafic qu’un classifieur Fable ne voulait pas traiter. Opus 5.5 paraît avec un ensemble proche de protections : les tâches de cybersécurité sont réalisées par Opus 4.8, et les tâches de biologie et de développement de LLM de frontière par Opus 5. Dans le journal, l’ID de requête est noté claude-opus-5-5, et le résultat peut encore venir d’un autre modèle. Les refus reviennent en HTTP 200, et stop_reason vaut "refusal".
Sonnet 5.5 est déjà dans le catalogue du 30 septembre 2026, au même prix unitaire $2 / $10 que Sonnet 5. Cette réponse ne contient pas Haiku 5.5. Les cartes Claude moins chères déjà listées sont Sonnet 5.5, Sonnet 5 à $2 / $10, et Haiku 4.5 à $1 / $5. Haiku 4.5 reste sur une fenêtre de 200K. Les groupes de Sonnet 5.5 sont dans l’évaluation de Sonnet 5.5.
C’est une position que l’on peut auditer à partir des documents : le prix catalogue, le modèle par défaut de Claude Code, quel modèle répond quand une protection se déclenche, et quelles lignes du tableau du fournisseur sont encore menées par Astra. Il n’y a pas ici d’affirmation sur la part de marché.
Contraintes à l’intégration
Requêtes qui renvoient directement 400
Un client qui ne fait que remplacer la chaîne du modèle rencontre encore les quatre changements incompatibles que la documentation liste pour « du code qui tournait sur Opus 5 ». Les trois premiers s’appliquent aussi à Fable 5.1. Voici la forme que la note de migration demande d’envoyer. Les commentaires marquent les variantes qui renvoient invalid_request_error.
model: claude-opus-5-5
thinking: {"type": "adaptive"}
tool_choice: {"type": "auto"}
output_config.effort: medium
# 400 : type de thinking égal à disabled, ou enabled avec budget_tokens
# 400 : tool_choice égal à any, ou tool_choice égal à tool
# 400, limité à la Claude API et à Google Cloud : type d’outil computer_20251124
La profondeur remplace l’ancien interrupteur de réflexion. Omettez thinking, ou envoyez adaptive. L’effort doit être fixé explicitement. auto et none pour tool_choice restent valides, y compris sur le point de terminaison qui compte les tokens. Pour obtenir du JSON conforme au schéma, la note de migration renvoie à l’appel d’outil strict ou à la sortie structurée, et à une ligne du prompt qui dit quand appeler l’outil.
Sur la Claude API et Google Cloud, remplacez computer_20251124 par le jeu d’outils computer_toolset_20260801 et retirez l’ancien en-tête bêta d’utilisation de l’ordinateur. Opus 5.5 sur Amazon Bedrock accepte encore computer_20251124. Les intégrations d’opérations de navigateur qui utilisent déjà ce jeu d’outils n’ont pas à modifier le code pour ce changement incompatible.
Pour les comptes créés le 31 août 2026 ou après, un rejeu qui modifie le préfixe devant un bloc de réflexion d’Opus 5.5 est le quatrième 400. Gardez la conversation en ajout seul.
Requêtes qui réussissent alors que le comportement change
Omettre l’effort fait maintenant tourner sur medium. La même omission faisait tourner sur high avec Opus 5. Une fois l’effort aligné, Opus 5.5 tend à réfléchir davantage à chaque tour qu’Opus 5, surtout à xhigh et à max. Une valeur d’effort copiée d’une configuration Opus 5 est un nouveau point de coût. Laissez de la place dans max_tokens pour les blocs de réflexion.
Le texte écrit entre les appels d’outils revient à l’intérieur des blocs de réflexion. Quand la valeur display par défaut est omitted, ces blocs sont vides. Une interface qui diffusait ce texte en flux devient silencieuse, et la requête elle-même réussit encore. Fixez une valeur display quand le produit a besoin de ces lignes de progression.
Le classifieur de biologie tourne en même temps que le classifieur de cybersécurité. Un prompt qui pousse le modèle à « copier son raisonnement dans la réponse visible » peut être refusé au titre de reasoning_extraction. Le guide de prompt dit que les graphiques et les captures d’écran se lisent déjà plus juste avant qu’un outil visuel soit ajouté ; les prompts qui compensaient autrefois une lecture faible des graphiques méritent donc d’être rejoués à part.
Quelles charges de travail évaluer d’abord
Rejouez Opus 5.5 sur les travaux que la page de lancement décrit très concrètement : une modification sur plusieurs fichiers, une migration avec les tests propres du dépôt, une note de recherche notée d’après ses sources, et un flux d’utilisation de l’ordinateur que l’on peut lancer deux fois. Notez le modèle demandé, le modèle qui a réellement répondu, l’effort, les tokens d’entrée, les tokens de lecture de cache, les tokens de sortie, le temps mur, les reprises et les modifications humaines. Les formules d’Anthropic « environ 40% de moins » et « environ un cinquième du coût » parlent de leur banc d’essai et ne remplacent pas cette feuille d’enregistrement.
Les tâches que le rejeu perd encore restent sur Fable 5.1, ou sur un repli explicite. Préparez comme du trafic Opus 4.8 celui que la protection de cybersécurité transférera, et comme du trafic Opus 5 celui que la protection transférera en biologie et en développement de modèles de frontière. Quand la tâche tient sur la carte à $2 / $10 et n’a pas besoin de la boucle Opus, continuez avec Sonnet 5.5 ou Sonnet 5.
Sur Modelflare, ce palier envoie claude-opus-5-5. La ligne du 30 septembre 2026 active trois groupes publics : claude-premium à 0.5 quand le coût d’un échec est élevé, claude-stable à 0.315 pour la production ordinaire, et claude-award à 0.25 quand l’appel peut être retenté. claude-tmp-cheap n’est pas activé sur ce modèle. Le prix utilisateur sur claude-stable est de $1.26 par million de tokens d’entrée et de $6.30 par million de tokens de sortie.
Sources
- Page de lancement, 22 septembre 2026 : https://www.anthropic.com/claude-opus-5-5
- Page du modèle, spécifications et ligne de comparaison actuelle : https://platform.claude.com/docs/en/models/opus-5-5/overview
- Nouveautés, changements incompatibles et grille de prix : https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5
- Configuration des modèles de Claude Code, modèle par défaut : https://code.claude.com/docs/en/model-config
- Interface de tarifs de Modelflare, lue le 30 septembre 2026 : https://modelflare.dev/api/pricing
- Évaluation de Fable 5.1 sur ce blog : évaluation de Fable 5.1