Anthropic a confirmé le 10 août 2026 que le tarif de lancement de Claude Sonnet 5 devient le tarif standard et permanent : 2 $ le million de tokens en entrée, 10 $ en sortie. La hausse à 3 $ / 15 $ prévue au 1er septembre 2026 n'aura pas lieu. Si tu avais provisionné une augmentation dans ton budget Q4, tu peux la retirer.
Cet article est fait pour toi si tu utilises l'API Claude en production, si tu factures des tokens à des clients, ou si tu hésites entre l'abonnement Claude.ai et un accès API direct. Pour le cadre général et les autres décisions d'outillage, va voir le guide complet pour apprendre Claude en 2026.
La confirmation en une phrase
Source officielle : la release note du 10 août 2026 sur platform.claude.com. Anthropic écrit que le tarif de lancement de claude-sonnet-5 (2 $ input, 10 $ output par million de tokens) devient le tarif standard. Ce n'est plus une promotion à durée limitée, ce n'est plus conditionné à une date de bascule. Deux analyses tech indépendantes publiées mi-août 2026 (TechJournal, ExplainX) confirment la lecture : la hausse annoncée en juin n'aura pas lieu.
Nuance importante à ne pas rater : ce changement concerne exclusivement le tarif API. Les abonnements Claude Pro (à partir de 20 € par mois), Max (à partir de 100 € par mois) et Team (à partir de 25 € par utilisateur) ne sont pas concernés par cette annonce, ils suivent leur propre grille.
Ce qui était prévu initialement et pourquoi ça a changé
Rappel du contexte. Claude Sonnet 5 est sorti le 30 juin 2026 avec un tarif d'appel présenté comme promotionnel : 2 $ / 10 $ le million de tokens, avec une bascule annoncée au 1er septembre vers 3 $ / 15 $. Cette bascule aurait représenté une hausse de 50 % sur input et output. Pour une équipe qui tourne à quelques centaines de millions de tokens par mois, ça se voyait dans le budget.
La release note d'Anthropic ne détaille pas les raisons du changement. Elle annonce le fait, point. Toute lecture au-delà (pression concurrentielle des baisses OpenAI du 30 juillet sur Luna et Terra, arbitrage marges/adoption, positionnement face à Gemini) est une analyse externe, pas une déclaration officielle. Je ne vais donc pas spéculer ici.
Un fait technique qui ne bouge pas : Sonnet 5 utilise un nouveau tokenizer qui produit environ 30 % de tokens en plus qu'un modèle antérieur à Opus 4.7, pour un même texte source. Ce chiffre est officiel, avec la précision qu'il varie selon le contenu. Le prix par token ne monte plus, mais un texte donné coûte toujours plus cher à traiter qu'avec Sonnet 4.6. J'y reviens plus bas parce que c'est le piège budgétaire le plus fréquent.
Le tarif API définitif de Sonnet 5 en détail
Voici la grille à retenir, valable pour tous les modèles Claude 5 d'après la KB du 16 août 2026.
| Modèle | Input (par M tokens) | Output (par M tokens) | Positionnement |
|---|---|---|---|
| Sonnet 5 | 2 $ | 10 $ | équilibre agentique/coût |
| Opus 5 | 5 $ | 25 $ | haut de gamme, contexte 1M |
| Fable 5 | 10 $ | 50 $ | modèle le plus intelligent |
| Haiku 4.5 | 1 $ | 5 $ | volume, latence basse |
Pour le prompt caching (documentation officielle vérifiée le 31 juillet 2026) : lecture facturée à 10 % du prix input standard (soit 90 % de réduction), écriture 5 minutes à 1,25x le tarif input, écriture 1 heure à 2x le tarif input. Sur Sonnet 5, une lecture de cache coûte donc 0,20 $ par million de tokens en entrée. C'est ce chiffre-là qui change la donne sur les prompts système répétés.
Situer Sonnet 5 dans la gamme : à 2 $ / 10 $, il est 2,5x moins cher qu'Opus 5 en input (5 $) et tout aussi loin de Sol de GPT-5.6 (5 $ / 30 $) sur ce même critère. C'est le tier travail quotidien d'Anthropic, modèle par défaut des plans Free et Pro depuis fin juin. Pour un aperçu détaillé du comparatif avec Opus 5 sorti le 24 juillet, va voir le duel Opus 5 vs Sonnet 5.
Ce que ça change concrètement pour ton budget
Trois scénarios pour rendre ça palpable. Les chiffres sont des ordres de grandeur, à ajuster à ton usage réel.
Solo qui utilise Claude via l'app pour du contenu. Tu écris, tu réfléchis, tu rediges des scripts et des emails dans Claude.ai. Tu ne touches pas à l'API. Ton coût mensuel : 20 € l'abonnement Pro. L'annonce du 10 août ne change rien pour toi côté grille, mais elle stabilise le paysage : pas de raison de reconsidérer ton plan cette année.
Consultant qui appelle l'API pour automatiser des livrables clients. Disons 40 M tokens input et 8 M tokens output par mois sur Sonnet 5 (un pipeline d'analyse de docs clients par exemple). À 2 $ / 10 $, ça donne 80 $ + 80 $ = 160 $ par mois. Au tarif qui était initialement prévu à partir du 1er septembre (3 $ / 15 $), la même charge coûtait 120 $ + 120 $ = 240 $. Économie de 80 $ par mois, soit environ 960 $ sur un an, sans changer une ligne de code.
Équipe de 3 avec pipeline en production. 400 M tokens input, 60 M tokens output par mois. À 2 $ / 10 $ : 800 $ + 600 $ = 1 400 $ par mois. Au tarif prévu qui n'arrivera pas : 1 200 $ + 900 $ = 2 100 $. Différence de 700 $ par mois, environ 8 400 $ sur un an. Pour une équipe à ce niveau d'usage, ça finance une partie du salaire mensuel d'un freelance ou une brique produit entière.
Une réserve honnête : ces économies s'entendent versus un tarif qui était annoncé mais n'a pas pris effet. Ce n'est pas une baisse de prix par rapport à ce que tu payais avant, c'est l'absence d'une hausse. Ton budget réel actuel ne bouge pas, il devient simplement projetable sur 12 mois sans provision de +50 %.
Comment optimiser ce tarif dès maintenant
Trois leviers concrets, par ordre d'impact.
Active le prompt caching sur tes prompts système. Si tu appelles l'API avec le même prompt système de 8 000 tokens sur 500 requêtes par jour, tu paies plein tarif input 500 fois. Avec le cache activé, la première requête paie 2,50 $ par million (écriture 5 min à 1,25x), les 499 suivantes paient 0,20 $ par million (lecture à 10 % du tarif). Sur ce type de charge, tu divises la facture de la partie répétée par cinq à dix selon la fréquence. Le seuil de rentabilité tombe très bas dès que tu appelles le même prompt plus de deux fois par heure.
Route vers le bon modèle selon la tâche. Pas besoin de Sonnet 5 pour classifier des tickets support en 3 catégories. Haiku 4.5 fait ça à 1 $ / 5 $, deux fois moins cher, avec une latence plus faible. Réserve Sonnet 5 aux tâches de raisonnement, d'agentique, de code. Réserve Opus 5 aux tâches où tu as besoin d'un contexte de 1M tokens ou d'une capacité de raisonnement supérieure. Pour un tour d'horizon de la nouvelle gamme complète, l'analyse de Fable 5 pose le décor.
Sépare temps réel et batch. Si une partie de ton pipeline n'a pas besoin de tourner en direct (analyses nocturnes, résumés de la veille, enrichissement de base de données), garde-la sur une file séparée que tu peux traiter avec des prompts optimisés et du cache maximal. Pour capitaliser sur ces workflows dans Claude.ai plutôt qu'en API, Projects et Artifacts te permettent de charger des instructions persistantes qui bénéficient du cache côté produit.
Piège budgétaire réel à surveiller : le nouveau tokenizer. Si tu migres depuis Sonnet 4.6 (le Sonnet historique, remplacé le 30 juin 2026), tes prompts existants produisent environ 30 % de tokens en plus. À prix par token identique, ta facture augmente donc mécaniquement d'environ 30 % pour un même volume de texte source. Utilise l'API de comptage de tokens d'Anthropic sur tes prompts réels pour mesurer l'écart au lieu de te fier à un pourcentage générique.
Sonnet 5 via API ou abonnement Claude.ai : où est le point de bascule
Calcul simple pour trancher entre un abonnement Claude Pro (20 € par mois, environ 22 $ selon le change) et un accès API direct sur Sonnet 5.
Sur un mix typique de 70 % input, 30 % output, le coût moyen par million de tokens tourne autour de 4,40 $. Avec 22 $ de budget mensuel, tu couvres environ 5 millions de tokens à l'API. En dessous de ce volume et si ton usage est concentré dans l'app (chat, écriture, réflexion, pas de dev), l'abonnement Pro reste plus économique et il te donne Projects, Artifacts et l'interface web.
Au-dessus de 5 à 6 millions de tokens par mois, et surtout si tu appelles l'API depuis un script, un serveur ou un produit, la bascule API devient rationnelle. À partir de là, active le cache et le calcul repart en ta faveur. Pour approfondir la logique d'abonnement selon ton profil, choisir le bon abonnement Claude selon ton usage fait le tour de la question.
Un cas où l'abonnement reste préférable même à haut volume : tu utilises Claude Code toute la journée depuis ton terminal. Les plans Pro et Max incluent Claude Code avec des limites qui, pour un usage individuel intensif, restent souvent plus économiques qu'un accès API direct sur les mêmes charges. Ottho a documenté l'usage de Claude Code au quotidien si c'est ton cas.
Ce qu'il faut retenir pour ton budget 2026
Le tarif API de Sonnet 5 est stable à 2 $ / 10 $ par million de tokens. Tu peux construire ton budget annuel sans provision de hausse. La grille des autres modèles (Opus 5, Haiku 4.5, Fable 5) est également documentée et n'a pas de bascule annoncée à ma connaissance. Garde une veille sur les release notes trimestrielles d'Anthropic, la grille peut évoluer avec de nouveaux modèles.
Trois actions à faire cette semaine si tu es en production : mesurer ton volume réel de tokens sur un mois type avec l'API de comptage, activer le cache sur tes prompts système répétés, router les tâches simples vers Haiku 4.5 plutôt que Sonnet 5. Ces trois actions font en général plus de différence sur ta facture que n'importe quelle négociation de prix.
Si tu veux structurer tout ça de façon cohérente, du setup API aux automatisations n8n en passant par un pipeline éditorial qui exploite le cache, la formation Maîtriser Claude au quotidien couvre chacun de ces sujets sur cinq semaines, un projet livrable par module.
