Claude Opus 5 : le nouveau modèle d'Anthropic (prix, contexte, ce qui change)

Anthropic a lancé Opus 5 le 24 juillet 2026. Prix identique à Opus 4.8, contexte 1M, gain net sur code long et agents. Voici ce qui change vraiment pour un entrepreneur qui utilise déjà Claude, et quand basculer depuis Sonnet 4.6 (ou pas).

Anthropic a lancé Claude Opus 5 le 24 juillet 2026. Un an après Opus 4, six mois après Sonnet 4.6, quelques semaines après Fable 5. Le rythme des sorties devient difficile à suivre, et la question pour toi qui utilises déjà Claude n'est pas "est-ce que c'est cool" mais "est-ce que je dois changer quelque chose à ce que je fais aujourd'hui". C'est la seule question qui compte. Si tu débutes et que tu cherches une base, va plutôt voir le guide complet pour apprendre Claude avant de te préoccuper de savoir quel modèle cocher.

Ce qui suit reprend les faits vérifiés au 25 juillet 2026 (release notes officielles d'Anthropic, TechCrunch, CNBC, 9to5Mac), sans les enrober du vocabulaire marketing habituel.

Ce qu'est Claude Opus 5 en une minute

Opus 5 (identifiant API : claude-opus-5) est le nouveau modèle haut de gamme d'Anthropic dans la gamme Claude classique. Il remplace Opus 4.8 au même prix, avec une amélioration décrite par Anthropic comme un "step-change". Le mode de réflexion ("thinking") est activé par défaut.

La gamme Claude en juillet 2026 se lit comme ça, du plus léger au plus lourd :

ModèlePositionnementPrix API (input / output, par million de tokens)
Haiku 4.5Rapide et pas cher, gros volumes1 $ / 5 $
Sonnet 4.6Équilibre vitesse/intelligence, le cheval de trait3 $ / 15 $
Opus 5Raisonnement long, code complexe, agents5 $ / 25 $
Fable 5Le plus intelligent, tier Mythos10 $ / 50 $

Opus 5 est un modèle pour les tâches où tu es prêt à payer deux fois plus que Sonnet pour un raisonnement plus profond. Ce n'est ni un remplaçant de Sonnet, ni un concurrent de Fable 5 (deux fois moins cher, deux fois moins ambitieux). Le positionnement repris par TechCrunch et CNBC : intelligence proche de Fable 5 pour environ la moitié du prix. À prendre avec la prudence habituelle sur ce genre de comparaison, mais l'ordre de grandeur est là.

Prix : combien coûte Opus 5 par rapport à Sonnet 4.6

Le tarif API n'a pas bougé par rapport à Opus 4.8 : 5 $ le million de tokens en entrée, 25 $ en sortie. Sonnet 4.6 reste à 3 $ / 15 $. Le ratio est d'environ 1,7x en entrée et 1,7x en sortie. Pas 5x, comme on lit parfois. C'est un point important : la marche entre Sonnet et Opus est plus douce qu'entre Opus et Fable 5.

Pour un ordre de grandeur concret. Prends un document de 50 pages (environ 30 000 tokens) que tu fais analyser avec une réponse structurée de 3 000 tokens :

ModèleCoût inputCoût outputTotal par requête
Sonnet 4.60,09 $0,045 $~0,14 $
Opus 50,15 $0,075 $~0,23 $
Fable 50,30 $0,15 $~0,45 $

Sur 100 analyses par mois, tu passes de 14 $ à 23 $. Sur 1 000 analyses, de 140 $ à 230 $. Ce n'est pas rien, mais ce n'est pas non plus le monde qui bascule. La question devient : est-ce que le gain qualitatif justifie 9 $ à 90 $ de plus par mois selon ton volume ?

Le cache API reste ton meilleur ami si tu réutilises le même contexte : lectures à -90 % du tarif input, écritures à 1,25x, durée minimale 30 minutes. Sur des agents qui rebouclent sur les mêmes documents de référence, tu peux diviser la facture par cinq ou dix.

Fenêtre de contexte et sortie max

Opus 5 a une fenêtre de contexte de 1 million de tokens par défaut, avec 128 000 tokens de sortie maximum. Sonnet 4.6 aussi. Haiku 4.5 plafonne à 200 000. Fable 5 : Anthropic n'a pas communiqué le chiffre.

1 million de tokens, c'est environ 750 000 mots. Un codebase moyen, un livre complet, un an de transcripts de réunions. Sur le papier, tu peux tout charger. En pratique, deux réserves.

D'abord, la qualité de rappel se dégrade sur les contextes très longs. Tous les modèles connus, Opus 5 inclus, oublient des détails du milieu du contexte, retrouvent mieux le début et la fin. Si tu comptes sur une info précise perdue à la page 400, tu vas être déçu. Le RAG bien fait reste plus fiable que "balancer tout dans le contexte".

Ensuite, le coût grimpe linéairement. 1 million de tokens en input à 5 $/M = 5 $ par requête, avant même la réponse. Si tu fais tourner ça en boucle dans un agent, tu brûles ton budget en une soirée. Utilise le contexte long pour ce qu'il permet vraiment : charger un dossier complet une fois, poser dix questions dessus avec le cache activé.

Ce qui change vraiment côté raisonnement et agents

Anthropic présente Opus 5 comme une avancée sur le code, le raisonnement long-format et les agents. La presse tech (TechCrunch, CNBC) reprend ce positionnement sans benchmarks chiffrés officiels publiés à ce stade. On reste donc au niveau qualitatif.

Un changement concret côté API mérite d'être noté, parce qu'il peut casser du code existant : sur Opus 5, désactiver le mode "thinking" n'est autorisé qu'aux niveaux d'effort "high" et en dessous. Si tu envoies une requête avec effort "xhigh" ou "max" et thinking désactivé, tu récupères une erreur. Sur Opus 4.8 c'était permis. Si tu as des scripts qui piochent au max sans thinking, ils vont casser.

Le réglage principal pour piloter Opus 5, c'est ce niveau d'effort (low, medium, high, xhigh, max). Plus tu montes, plus le modèle réfléchit longtemps, plus tu payes en tokens de sortie. Pour un usage entrepreneur au quotidien, medium ou high suffit largement. Xhigh et max sont pour des tâches où tu es prêt à attendre plusieurs minutes une réponse.

Les cas où le gain est le plus net, si tu veux hiérarchiser tes tests :

  • Refactoring de codebase entière chargée dans le contexte
  • Analyse juridique ou financière longue avec raisonnement multi-étapes
  • Agents autonomes qui enchaînent 20+ appels d'outils
  • Debug de bugs subtils où Sonnet tourne en rond

Pour tout ce qui est rédaction, synthèse de réunion, réponse email, extraction structurée, brief SEO, Sonnet 4.6 fait aussi bien, plus vite, moins cher.

Opus 5 vs Sonnet 4.6 : lequel choisir pour ton usage

Voici la grille que j'utilise pour trancher, sans complaisance envers Opus :

Cas d'usageSonnet 4.6Opus 5
Rédaction blog, emails, copywritingSuffit largementOverkill
Résumé de documents courtsSuffitNon
Extraction de données structuréesSuffitNon
Prompts quotidiens dans Claude.aiDéfaut raisonnablePour tâches spécifiques
Code simple, scripts, correctionsBonOverkill
Refactor multi-fichiersLimiteLà où il brille
Agents autonomes long-formatÇa passeRecommandé
Analyse dossier de 500 pagesÇa passe si bien découpéRecommandé

Si tu as un doute, commence toujours par Sonnet et bascule sur Opus seulement quand tu vois que la qualité ne suit pas. L'inverse coûte cher et n'apporte souvent rien. Pour choisir le bon abonnement Claude en fonction de tes usages, la même logique s'applique côté Claude.ai.

Opus 5 vs GPT-5.6 Sol et Fable 5 : où il se place

Le concurrent direct d'Opus 5 côté OpenAI, c'est GPT-5.6 Sol, à 5 $/30 $ le million de tokens. Prix input identique, output plus cher chez OpenAI. Sur les benchmarks publiés en juillet 2026, Sol prend l'avantage sur certains index composites, Fable 5 reste devant sur SWE-Bench Pro (80 % vs 64,6 %). Opus 5 n'a pas encore été benchmarké publiquement de la même façon.

Ce qui compte pour un entrepreneur, plus que les scores : l'écosystème autour. Anthropic pousse fort sur MCP, Claude Code, les Projects, les agents. Si ton stack repose sur Claude Code ou sur les Projects et Artifacts, migrer chez OpenAI pour gratter quelques points de benchmark n'a pas de sens. Reste sur Claude et arbitre entre Sonnet, Opus 5 et Fable 5 selon la tâche.

Comment y accéder

Opus 5 est disponible dès le lancement sur l'API Claude directe, Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry. Côté Claude.ai, le modèle apparaît dans le sélecteur des interfaces payantes. Pour les détails précis de disponibilité par plan (Pro, Max, Team, Enterprise), Anthropic n'a pas publié de matrice officielle et complète à la date de rédaction, donc je préfère te dire de vérifier dans ton compte plutôt que d'affirmer des choses non recoupées.

Dans Claude Code, tu peux basculer sur Opus 5 pour les tâches lourdes tout en gardant Sonnet en défaut. Utile pour un refactor ponctuel, coûteux si tu le laisses par défaut sur toute ta journée de travail.

Faut-il migrer tes prompts existants

C'est la question que personne ne pose et qui te fera perdre le plus de temps si tu l'ignores. Les prompts calibrés pour Opus 4.8 ou Sonnet 4.6 peuvent produire des sorties différentes sur Opus 5. Pas forcément moins bonnes, différentes. Sur les sorties structurées (JSON, XML), les changements de format sont ceux qui cassent le plus vite les pipelines en aval.

La méthode que je recommande :

  1. Identifie tes trois prompts les plus critiques (ceux qui tournent en production, en agent, ou dans un pipeline automatisé).
  2. Passe-les en A/B sur 20 à 50 exécutions comparées Sonnet 4.6 vs Opus 5.
  3. Compare la qualité, le format, la stabilité de sortie, le coût réel.
  4. Ne bascule que ceux où le gain qualitatif est net. Garde les autres sur Sonnet.
  5. Si tu as un pipeline SEO ou éditorial calibré, ajuste-le en douceur (voir comment intégrer un modèle plus lourd dans un pipeline SEO sans exploser le budget).

Voici un exemple de commande pour tester rapidement via l'API :

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-opus-5",
    "max_tokens": 2000,
    "thinking": {"type": "enabled", "budget_tokens": 8000},
    "messages": [{"role": "user", "content": "Ton prompt ici"}]
  }'

Change le model pour claude-sonnet-4-6, relance, compare. Tu sauras en une après-midi si le passage à Opus 5 vaut le coût sur ton cas précis.

Ce qu'il faut en retenir

Opus 5 est une bonne mise à jour, pas une révolution. Le prix ne bouge pas par rapport à Opus 4.8, la fenêtre de contexte reste à 1M tokens comme Sonnet, le gain se voit sur les tâches longues et complexes. Pour 80 % de ce qu'un entrepreneur fait avec Claude, Sonnet 4.6 reste le bon choix. Bascule sur Opus 5 quand tu tapes le mur qualitatif de Sonnet, pas par principe.

Si tu veux structurer une pratique quotidienne solide autour de Claude (choix des modèles, prompts, Projects, MCP, agents), c'est exactement ce qu'on couvre dans le programme Maîtriser Claude au quotidien. Cinq modules, cinq semaines, cinq projets concrets, pour arrêter de deviner et commencer à décider.

Pilier 1 · Mastery

Maîtriser Claude au quotidien : configuration, abonnements, premiers prompts

Choisir son plan Claude, configurer son environnement, comprendre la différence entre Claude.ai, Projects et Artifacts.

Découvrir le pilier complet →