Le 10 août 2026, Anthropic a mis à jour une ligne de sa documentation tarifaire, sans communiqué de presse ni annonce fracassante. Cette ligne dit que la hausse de prix programmée pour Claude Sonnet 5 le 1er septembre n'aura pas lieu : les 2 dollars par million de tokens en entrée et 10 dollars en sortie, affichés comme un tarif de lancement temporaire, deviennent le prix définitif. Bonne nouvelle pour les budgets IA de la rentrée, sauf qu'un second changement, plus discret, pèse déjà sur la facture réelle de vos équipes.

Ce qu'Anthropic vient de confirmer sur le prix de Sonnet 5

Combien de comités budgétaires ont déjà validé, cet été, une ligne « IA générative » en anticipant une hausse de 50 % au 1er septembre ? Beaucoup, à en juger par les échanges avec nos clients depuis juillet. Claude Sonnet 5 est sorti le 30 juin 2026 avec un tarif de lancement de 2 dollars par million de tokens en entrée et 10 dollars en sortie, valable jusqu'au 31 août. Passé cette date, la grille devait légalement basculer à 3 dollars et 15 dollars, soit 50 % de plus sur chaque facture d'API.

Ce basculement n'aura pas lieu. La documentation tarifaire officielle d'Anthropic l'indique désormais noir sur blanc : le tarif de 2 dollars et 10 dollars par million de tokens, annoncé au lancement comme une offre d'introduction, devient le prix standard. « The previously scheduled increase to $3/$15 per million input/output tokens on September 1, 2026 will not occur », écrit littéralement l'entreprise dans sa page de tarification, sans détailler publiquement les raisons de ce revirement.

L'écart n'a rien de symbolique sur le papier : la grille annulée représentait une hausse de 50 % sur chaque ligne de facturation Sonnet 5, en entrée comme en sortie. Nous avions détaillé les enjeux de cette tarification dès le lancement dans notre article sur l'arrivée de Sonnet 5 et Fable 5, où la question restait justement de savoir si le tarif d'appel tiendrait dans la durée. Elle a tenu. Reste un second mouvement, moins visible, qui mérite qu'on s'y arrête avant de crier victoire budgétaire.

Le tokenizer qui grignote discrètement l'économie annoncée

Un tokenizer, c'est la brique qui découpe un texte en unités que le modèle traite une par une ; changer de tokenizer, c'est changer combien d'unités il faut pour dire la même chose. Depuis Claude Opus 4.7, et désormais avec Sonnet 5, Anthropic utilise un tokenizer différent de celui des modèles 4.6 et antérieurs. Sa documentation technique est directe sur ce point : ce nouveau découpage produit environ 30 % de tokens en plus pour un texte strictement identique, un écart qui varie selon le type de contenu traité.

Qui absorbe ces 30 % ? Vous, mécaniquement, puisque la facture se calcule sur le nombre de tokens consommés, pas sur le nombre de mots ou de caractères. Un contrat de 50 pages qui consommait 40 000 tokens en entrée sous Sonnet 4.6 en consomme environ 52 000 sous Sonnet 5, même prix par token, même contrat, même texte. Le tarif reste gelé ; la quantité facturée, elle, augmente.

C'est un peu comme un fournisseur d'énergie qui gèlerait le prix du kilowattheure tout en installant, au même moment, un compteur qui tourne 30 % plus vite sur la même consommation réelle. Le prix affiché n'a pas menti. La facture, elle, raconte une autre histoire.

Plusieurs cabinets spécialisés dans le coût des API d'IA ont refait le calcul depuis l'annonce du 10 août. Leur exemple type : un usage qui coûtait 1 000 dollars par mois sous Sonnet 4.6 revient, à volume de texte identique, à environ 1 300 dollars par mois sous Sonnet 5, l'écart s'expliquant uniquement par le nouveau découpage en tokens, le tarif nominal restant pourtant inchangé. Si la hausse du 1er septembre avait été maintenue en plus de cet effet tokenizer, la même charge aurait grimpé vers 1 950 dollars, presque le double de la facture de départ. L'annulation de la hausse évite ce second étage, pas le premier.

L'ampleur de l'écart dépend du type de contenu. Le code source, les données structurées et les textes rédigés dans une langue autre que l'anglais comptent parmi les cas où la documentation d'Anthropic signale un effet plus marqué. Un cabinet juridique qui traite surtout du français long format n'observera pas forcément le même écart qu'une équipe qui fait analyser des exports CSV ou des scripts Python.

Comment vérifier l'écart sur vos propres prompts

La vérification ne demande pas un audit complexe. La console et l'API Claude exposent un point de terminaison de comptage de tokens qui accepte n'importe quel prompt et renvoie le nombre exact d'unités qu'il consommera, avant même d'envoyer la requête au modèle. Faites tourner vos dix prompts systèmes les plus utilisés sur ce compteur, une fois tels qu'ils sont rédigés aujourd'hui, une fois après un exercice de reformulation plus dense. L'écart entre les deux résultats donne une estimation concrète, propre à votre organisation, de la marge de manœuvre qui reste face au nouveau tokenizer, indépendamment des moyennes publiées par des cabinets tiers.

Pourquoi Anthropic recule sur la hausse plutôt que de l'assumer

18 % des entreprises implantées en France utilisaient au moins une intelligence artificielle en juillet 2026, selon une note de l'Insee publiée le 21 juillet. Le chiffre grimpe à 42 % du côté des PME ayant franchi le pas d'au moins un déploiement, mais l'écart entre grandes entreprises et structures plus petites reste net. Dans ce contexte d'adoption encore fragile, relever le prix d'un des modèles les plus utilisés en production revenait à ajouter un frein au moment où l'industrie cherche justement à en retirer.

Les PME qui composent une bonne partie de ce 42 % d'adoption n'ont pourtant pas le même rapport de force qu'un grand compte face à Anthropic. Une hausse de 50 % aurait pesé, en proportion, bien plus lourd sur leur budget IA que sur celui d'un groupe capable de négocier une remise volume. Geler le tarif d'entrée revient aussi à préserver l'attractivité de Sonnet 5 auprès du segment qui a le plus à perdre d'un choc tarifaire, et le plus de mal à l'anticiper dans un budget annuel déjà serré.

Sonnet 5 n'est pas un modèle parmi d'autres dans le catalogue d'Anthropic. C'est le modèle par défaut de nombreux déploiements Claude Cowork en entreprise, celui qui traite le plus gros volume de tâches agentiques du quotidien : tri d'emails, préparation de comptes rendus, premiers jets de documents. Toucher son prix revient à toucher directement le coût marginal de l'automatisation la plus répandue, pas celui d'un usage de niche réservé à quelques équipes techniques.

L'ironie, c'est qu'Anthropic communique depuis des mois sur sa volonté de transformer Claude en agent qui exécute des tâches de bout en bout plutôt qu'en simple assistant qui répond. Une hausse de 50 % sur le modèle qui porte cette ambition aurait envoyé un signal contradictoire à des directions financières déjà prudentes sur leurs engagements IA pluriannuels. Geler le prix, c'est aussi geler l'argument principal qu'on opposerait à un déploiement plus large.

Reste que la documentation d'Anthropic ne motive pas publiquement ce choix. Aucune communication dédiée, aucun chiffre d'adoption cité en interne : seulement une ligne mise à jour dans une page technique. Le silence sur les raisons n'enlève rien à l'effet concret sur les factures, mais il complique l'exercice pour qui cherche à anticiper la prochaine décision tarifaire.

Ce que ça change pour votre budget IA, secteur par secteur

Pour une direction financière, la bonne nouvelle du 10 août ne dispense d'aucune vérification. La ligne à surveiller n'est plus le prix par million de tokens, gelé et donc prévisible, mais le volume de tokens réellement consommé mois après mois, lui, mécaniquement à la hausse depuis le passage à Sonnet 5. Un tableau de suivi qui ne regarde que le tarif contractuel passe à côté de l'essentiel.

La documentation technique d'Anthropic recommande trois pistes concrètes, indépendantes de la question tarifaire : réserver Haiku aux tâches simples et répétitives, garder Sonnet pour la majorité des charges de production, et ne monter vers Opus que pour le raisonnement le plus complexe. Un centre de support qui traite 10 000 tickets avec Haiku 4.5 dépense environ 37 dollars, contre une facture nettement supérieure si chaque ticket passait par un modèle plus coûteux sans justification métier.

Le cache de prompts constitue un second gisement d'économies, souvent sous-exploité. Une relecture en cache coûte 10 % du prix d'entrée standard, ce qui rentabilise la mise en cache dès la deuxième lecture d'un même contexte sur une fenêtre de cinq minutes. Pour une équipe qui fait relire le même contrat type par Claude à longueur de journée, avec le même socle de clauses en tête de prompt, l'écart cumulé se voit directement sur la facture mensuelle.

Pour les traitements qui n'exigent pas une réponse immédiate, comme le codage de masse de documents ou la préparation de rapports de fin de mois, l'API Batch d'Anthropic applique une remise de 50 % sur les tokens d'entrée et de sortie. Un cabinet de conseil qui traite ses livrables de fin de mission par lot plutôt qu'en flux continu peut absorber une bonne partie de l'effet tokenizer par ce seul choix d'architecture, sans changer une ligne de prompt.

Les cabinets qui refacturent une partie de leurs coûts technologiques à leurs clients ont une raison supplémentaire de suivre cet écart de près : un forfait calculé sur les coûts constatés avant le 30 juin sous-estime désormais la réalité, tokenizer compris. Réviser la grille de refacturation interne évite de transformer une hausse de coût invisible en perte sèche sur les missions en cours.

Même logique côté assurance et courtage : les volumes élevés de réclamations et de pièces jointes traités chaque jour font ressentir l'effet tokenizer plus vite que dans d'autres secteurs. Un contrôle mensuel du nombre de tokens consommés par type de dossier, comparé au même contrôle réalisé en juin, avant la bascule vers Sonnet 5, donne une mesure directe de l'écart réel plutôt qu'une estimation calquée sur la moyenne du marché.

Ces réglages, choix du modèle, cache et traitement par lot, complètent utilement les outils de pilotage que nous avions présentés dans notre article sur le contrôle des coûts sur Claude Enterprise. Les quotas par modèle et les alertes de dépense servent à détecter une dérive ; le choix du bon modèle et du bon mode d'appel servent, eux, à ne pas la créer en premier lieu.

Comment ClaudIn cadre cette bascule tarifaire chez ses clients

Chez ClaudIn, l'annonce du 10 août a immédiatement changé une partie des audits que nous menons avec nos clients. Avant, l'exercice consistait surtout à vérifier que la migration vers Sonnet 5 tenait ses promesses de performance. Depuis, il inclut systématiquement un comptage réel des tokens consommés avant et après bascule, comparé au tarif désormais permanent, pour objectiver l'écart plutôt que de le deviner.

Combien de vos prompts systèmes actuels ont été rédigés à l'époque de Sonnet 4.6, avec un style d'écriture pensé pour un tokenizer différent ? La question n'est pas anecdotique : un prompt système verbeux, jamais retravaillé depuis son écriture initiale, paie deux fois le changement de tokenizer, une fois sur le contenu utile, une fois sur l'habitude rédactionnelle héritée de l'ancien modèle. Le nettoyer ne prend souvent qu'une demi-journée de travail.

L'audit tient en deux semaines dans la plupart des cas : une semaine pour extraire les volumes de tokens réels depuis la console Claude Enterprise, une semaine pour tester un mix de modèles alternatif sur un échantillon représentatif de tâches. Le livrable final tient sur une page : le montant économisable, les cas d'usage concernés et l'ordre dans lequel les traiter.

Dans nos missions les plus consommatrices d'API, l'audit tokenizer s'accompagne désormais d'une revue complète du mix de modèles utilisé sur chaque cas d'usage. Le résultat surprend régulièrement les équipes : une partie non négligeable des volumes tourne sur Sonnet ou Opus alors qu'ils pourraient, dans plusieurs cas, basculer sur Haiku sans perte de qualité perceptible pour l'utilisateur final.

Nos sessions de formation Claude Cowork intègrent désormais un module dédié à la lecture d'une facture Anthropic poste par poste, pensé pour des équipes qui n'ouvriront jamais elles-mêmes la console de facturation mais qui devront vivre avec les choix qui y sont faits.

La hausse de prix du 1er septembre n'aura donc pas lieu. Votre facture Sonnet 5, elle, a déjà changé de forme depuis le 30 juin, et continuera de refléter le nouveau tokenizer tant que vos prompts et votre mix de modèles n'auront pas été révisés en conséquence. Quel est, aujourd'hui, l'écart réel entre ce que vous pensiez payer pour Sonnet 5 et ce que vous payez vraiment ? Si la réponse n'est pas immédiate, réservez un audit de 30 minutes avec notre équipe pour la trouver.