Claude propose deux grilles tarifaires qui ne mesurent pas la même chose. L’API facture chaque token envoyé et reçu. Un abonnement Claude facture un forfait mensuel fixe pour un volume plafonné de conversation et de temps de codage. Mal choisir, et vous payez des tokens que vous utilisez à peine, ou vous atteignez une limite d’usage au beau milieu d’un délai serré. Cet article chiffre les deux options à partir des tarifs publiés par Anthropic en octobre 2026, pour que vous voyiez où le compteur au token l’emporte et où un forfait fixe est plus avantageux.

Chaque requête API est mesurée. Vous payez le texte envoyé, le texte généré et quelques options, le tout mesuré en tokens. Les prix sont exprimés par million de tokens, notés MTok, donc $2 / MTok signifie $2 pour chaque million de tokens. Il n’y a ni abonnement mensuel, ni nombre de sièges, ni plafond : la facture suit le trafic.
Ce qui compte comme token
Un token est un morceau de texte, en général un mot court ou une partie d’un mot plus long. La règle empirique d’Anthropic est d’environ 4 caractères ou 0,75 mot d’anglais par token, donc un article de 2 500 mots représente à peu près 3 300 tokens. Le code, les textes non anglais et la mise en forme poussée en prennent généralement davantage.

Un détail compte quand on compare d’anciennes et de nouvelles grilles tarifaires. Claude 4.7 et les versions ultérieures utilisent un nouveau tokenizer qui produit environ 30 % de tokens en plus pour le même texte que Sonnet 4.6 et les versions antérieures. Un prix plus bas par token ne signifie pas toujours une facture plus basse si votre prompt se découpe désormais en davantage de tokens.
Pourquoi la sortie coûte plus cher
Les tokens de sortie coûtent cinq fois plus que les tokens d’entrée sur la gamme actuelle. Sonnet 5.5 facture $2 par million de tokens d’entrée et $10 par million de tokens de sortie. Opus 5.5 facture $4 et $20. Générer du texte est l’étape coûteuse, tandis que lire un prompt ne coûte pas grand-chose.
Ce ratio détermine la façon dont vous économisez. Les longs documents envoyés coûtent peu. Les longues réponses renvoyées coûtent cher. Un prompt demandant trois puces coûte moins qu’un prompt qui invite à un essai de 2 000 mots.
Comment l’historique de conversation gonfle la facture
L’API est sans état : chaque nouveau tour renvoie toute la conversation, et vous payez tout en entrée une nouvelle fois. Imaginez une discussion où vous tapez 500 tokens et où le modèle répond avec 500 tokens, pendant dix tours. Vous n’avez écrit que 5 000 tokens de texte nouveau, mais le compteur d’entrée atteint 50 000 tokens sur les dix appels, car le tour 10 renvoie tout ce qui s’est passé du tour 1 au tour 9.
Sur Sonnet 5.5, cette conversation coûte $0,10 en entrée plus $0,05 pour les 5 000 tokens de sortie, soit $0,15 au total. C’est peu en soi. Multipliez par cent conversations par jour et l’historique devient la plus grosse ligne de la facture, et c’est précisément là que le cache aide.

Tarifs de l’API Claude par modèle
Tarifs actuels par million de tokens
Ce sont les tarifs de la page de prix d’Anthropic, en dollars américains par million de tokens. La dernière colonne est le prix d’une lecture depuis le cache de prompt, la façon la moins chère de renvoyer un texte déjà envoyé.

| Modèle | Entrée | Sortie | Lecture du cache |
|---|
| Claude Haiku 5.5 (prompts jusqu’à 100K tokens) | $0,10 | $0,50 | $0,01 |
| Claude Haiku 4.5 | $1 | $5 | $0,10 |
| Claude Sonnet 5.5 | $2 | $10 | $0,10 |
| Claude Sonnet 4.6 | $3 | $15 | $0,30 |
| Claude Opus 5.5 | $4 | $20 | $0,20 |
| Claude Fable 5.1 | $10 | $50 | $0,25 |
Haiku 5.5 est tarifé selon la longueur du prompt : au-delà de 100 000 tokens, les prompts paient $0,50 en entrée et $2,50 en sortie.
💡 Le plus récent n’est pas toujours le plus cher. Opus 5.5 à $4 / $20 est moins cher que la génération Opus 5 et Opus 4.8 à $5 / $25, et Sonnet 5.5 à $2 / $10 est moins cher que Claude Sonnet 4.6 à $3 / $15. Vérifiez la grille tarifaire avant de supposer que le plus gros chiffre revient au modèle le plus récent.
Ce que coûte réellement une requête
Prenons une requête typique : 3 000 tokens d’entrée (un prompt système plus un document collé) et 800 tokens de sortie (une réponse solide). Voici le calcul par requête et pour mille requêtes, avec les mêmes nombres de tokens sur chaque ligne pour garder la comparaison simple.
| Modèle | Coût par requête | Coût pour 1 000 requêtes |
|---|
| Claude Haiku 5.5 | $0,0007 | $0,70 |
| Claude Haiku 4.5 | $0,007 | $7,00 |
| Claude Sonnet 5.5 | $0,014 | $14,00 |
| Claude Sonnet 4.6 | $0,021 | $21,00 |
| Claude Opus 5.5 | $0,028 | $28,00 |
| Claude Fable 5.1 | $0,070 | $70,00 |
L’écart entre la ligne la moins chère et la plus chère est de 100 fois. Le choix du modèle fait davantage varier la facture que n’importe quelle décision de forfait. Comme les modèles récents découpent le même texte en plus de tokens, ajoutez jusqu’à 30 % aux lignes 4.7 et ultérieures en usage réel.
Remises sur le cache et les lots

Deux remises font l’essentiel de l’économie, et elles se cumulent :
- Mise en cache du prompt. Écrire un préfixe de prompt dans le cache de 5 minutes coûte 1,25x le prix d’entrée de base, et le cache d’une heure coûte 2x. Chaque lecture ensuite coûte 0,1x. Sur Opus 5.5 et Sonnet 5.5, une lecture coûte seulement 0,05x, et sur Fable 5.1 elle coûte 0,025x. Le cache de 5 minutes est rentabilisé après une seule lecture.
- Batch API. Les tâches asynchrones bénéficient de 50 % de réduction sur les tokens d’entrée et de sortie. Sonnet 5.5 passe à $1 / $5 et Opus 5.5 à $2 / $10.
La mise en cache aide moins qu’on ne le pense quand les réponses sont longues, car la sortie n’est pas remisée. Une session de codage avec 50 000 tokens d’entrée et 15 000 tokens de sortie coûte $0,50 sur Opus 5.5. Si vous servez 40 000 de ces tokens d’entrée depuis le cache, le coût tombe à environ $0,35, soit une économie de 30 %, car les $0,30 de sortie restent identiques.
Ce que coûtent les abonnements
Free, Pro et Max
Un abonnement remplace le compteur par un plafond. Vous payez un prix fixe et Claude limite votre usage sur des fenêtres glissantes de cinq heures, le nombre exact de messages dépendant de la longueur et de la complexité de chacun.

| Offre | Prix | Ce que vous obtenez |
|---|
| Free | $0 | Chat sur le web, bureau et mobile, avec recherche web, création de fichiers, exécution de code et mémoire |
| Pro | $20 par mois, ou $17 par mois facturé annuellement | Plus d’usage que Free, plus Claude Code, Projects et des modèles supplémentaires |
| Max 5x | $100 par mois | Cinq fois l’usage de Pro, limites de sortie plus élevées et accès anticipé aux nouvelles fonctionnalités |
| Max 20x | $200 par mois | Vingt fois l’usage de Pro |
Sièges Team et Enterprise

Les sièges Team standard coûtent $20 par siège et par mois en facturation annuelle, ou $25 en facturation mensuelle. Les sièges Premium coûtent $100 par siège et par mois en facturation annuelle ($125 en mensuel) et donnent cinq fois l’usage d’un siège standard. Enterprise commence à $20 par siège et par mois en facturation annuelle, avec un usage facturé aux tarifs de l’API, et ajoute SCIM, les journaux d’audit, la conservation des données personnalisée et le contrôle d’accès basé sur les rôles.
Pourquoi l’API est facturée séparément
Un abonnement Claude n’inclut pas de crédits API. Anthropic facture l’API séparément de ses offres, donc un abonnement Pro à $20 ne suffira pas à financer une application que vous livrez à vos clients. Cela nécessite un accès API avec sa propre facturation. Les abonnés Individual et Team peuvent acheter des crédits d’usage supplémentaires aux tarifs standard de l’API une fois les limites de l’offre atteintes, ce qui sert de soupape de sécurité pendant les semaines chargées.
Où se situe le seuil de rentabilité
Le test le plus simple consiste à diviser le prix de l’offre par votre coût par requête. Pour le forfait Pro à $20 et la requête de 3 000 tokens d’entrée et 800 tokens de sortie vue plus haut, le seuil de rentabilité se présente ainsi :

| Modèle | Coût par requête | Requêtes pour atteindre $20 | Par jour sur 30 jours |
|---|
| Claude Haiku 5.5 | $0,0007 | 28 571 | environ 952 |
| Claude Sonnet 5.5 | $0,014 | 1 429 | environ 48 |
| Claude Opus 5.5 | $0,028 | 714 | environ 24 |
| Claude Fable 5.1 | $0,070 | 286 | environ 10 |
Ce comparatif ne porte que sur le coût. Une offre inclut aussi une interface de chat, Projects et des connexions aux applications, alors que l’API vous donne un accès brut et rien d’autre. Il vous faut une application ou un outil qui l’appelle.
Utilisateurs de chat occasionnels
Si vous posez quelques questions par jour, le paiement au token est presque toujours moins cher. Trente requêtes Sonnet 5.5 par jour pendant un mois reviennent à environ $12,60, et la même habitude sur Haiku 5.5 coûte quelques centimes. Le forfait fixe ne gagne sur le prix qu’une fois que votre volume dépasse le seuil de rentabilité, ou lorsque l’interface et les extras comptent davantage que la facture la plus basse.
Agents de codage intensifs

Le codage agentique inverse la réponse. Utilisez les nombres de tokens de l’exemple de session d’une heure donné par Anthropic lui-même : 50 000 tokens d’entrée et 15 000 tokens de sortie. Sur Opus 5.5, cela fait $0,50 par session sans cache. Vingt sessions dans une journée de travail font $10, soit environ $220 sur 22 jours ouvrés, ce qui dépasse les $200 de l’offre Max 20x.
Le cache réduit l’écart. À environ $0,35 par session, les mêmes vingt sessions par jour coûtent à peu près $153 par mois. Dans les deux cas, un utilisateur intensif se place bien au-dessus de l’offre Max 5x à $100, ce pour quoi les paliers fixes ont été conçus. La contrepartie est que les plafonds d’usage de l’offre s’appliquent toujours.
Coûts cachés à prévoir dans votre budget
Le calcul des tokens ne représente pas toute la facture. Ces extras sont faciles à oublier :
- Recherche web : $10 pour 1 000 recherches, plus les tokens que les résultats ajoutent à votre prompt. La récupération web n’a pas d’autre frais que les tokens.
- Inférence US uniquement : Régler
inference_geo sur "us" applique un multiplicateur de 1,1x à chaque catégorie de tokens sur les modèles Claude 4.6 et ultérieurs.
- Mode rapide : Opus 5.5 en mode rapide coûte $8 en entrée et $40 en sortie par MTok, soit le double du tarif standard.
- Managed Agents : Les tokens sont facturés aux tarifs normaux, plus $0,08 par heure de session pendant son exécution.
- Surcoût lié aux outils : Toute requête avec des outils ajoute un prompt d’outil intégré, environ 286 tokens sur la génération 5.5, avant vos propres définitions d’outils.
- Changement de tokenizer : Jusqu’à 30 % de tokens en plus pour le même texte sur Claude 4.7 et les versions ultérieures.
💡 Conseil budget : Suivez cache_read_input_tokens dans les réponses de l’API. S’il reste à zéro sur des requêtes répétées, c’est qu’un élément de votre préfixe de prompt change à chaque appel, et vous payez plein tarif pour un texte que vous pourriez lire depuis le cache.
Utiliser Claude Sonnet 5 sur PicassoIA
Si vous voulez essayer Claude sans ouvrir de compte API ni surveiller un compteur de tokens, Claude Sonnet 5 est disponible sur Picasso IA. C’est la génération Sonnet précédente, tarifée sur l’API au même $2 / $10 que Sonnet 5.5, et sa page mentionne parmi ses fonctionnalités le codage multi-étapes, l’usage d’outils et l’entrée d’images.
Configuration pas à pas
- Ouvrez la page du modèle. Rendez-vous sur Claude Sonnet 5 sur Picasso IA.
- Rédigez votre prompt. Le champ Prompt est la seule entrée obligatoire. Collez la trace d’erreur, le document ou la question.
- Réglez le niveau d’effort. La valeur par défaut est
low, qui désactive la réflexion pour des réponses plus rapides et moins chères. Passez à medium ou high pour des tâches de codage plus difficiles, et à xhigh ou max pour les bugs qui touchent plusieurs fichiers.
- Limitez la sortie. Max Tokens est fixé à 8 192 par défaut. Abaissez-le si vous voulez des réponses courtes, car la sortie est le côté coûteux de toute grille tarifaire Claude.
- Ajoutez un prompt système. C’est facultatif. Fixez une fois un rôle ou un style de codage, puis réutilisez-le dans un projet.
- Joignez une image. C’est facultatif également. Une capture d’écran d’une erreur ou un croquis de maquette sert de contexte.
- Lancez et affinez. Lisez la réponse, resserrez le prompt et relancez.
Conseils sur les paramètres
| Paramètre | Valeur par défaut | Modifiez-le quand |
|---|
| Effort | low | La réponse manque de détails, ou le bug s’étend sur plusieurs fichiers |
| Max Tokens | 8192 | Vous voulez des réponses plus courtes ou des blocs de code plus longs |
| Prompt système | vide | Vous avez besoin d’un rôle, d’un ton ou d’un style de codage fixe |
| Résolution max. de l’image | 0,5 mégapixel | Le petit texte d’une capture d’écran se perd après la mise à l’échelle |
💡 Lancez le même prompt sur Claude Sonnet 4.6 et Claude 4.5 Haiku pour voir l’écart de qualité avant de choisir un modèle pour votre budget API. Pour les problèmes de codage les plus ardus, essayez Claude Fable 5.
Choisir la bonne configuration
Associez l’option à la charge de travail :
- Discussion, rédaction et recherche pour vous : commencez par Free. Passez à Pro à $20 quand vous atteignez les limites.
- Agents de codage au quotidien : Max 5x ou Max 20x, car les sessions intensives coûtent plus cher au compteur que le prix fixe.
- Un produit ou une automatisation : l’API, avec Haiku 5.5 ou Sonnet 5.5, en activant la mise en cache du prompt et les tâches par lots partout où la latence le permet.
- Une équipe : des sièges Team pour les personnes, plus l’API pour tout ce que vous livrez.
- Les deux : beaucoup de personnes souscrivent une offre pour un usage personnel et un accès API pour l’automatisation, puisque les deux sont facturés séparément.
Le choix le moins cher est celui qui correspond à votre façon réelle de travailler. Passez donc une semaine à compter vos requêtes avant de vous engager.
Votre prochaine étape sur PicassoIA
Les calculs de prix sont plus simples quand vous avez quelque chose à construire, et Picasso IA est un endroit rapide pour essayer à la fois le texte et les images. Ouvrez Claude Sonnet 5 pour rédiger vos prompts, puis transformez-les en images avec un modèle d’image comme GPT Image 2, Flux 2 Pro ou P-Image, le modèle à l’origine des photos de cet article.
Choisissez une scène, décrivez la lumière et l’objectif, puis lancez la génération. Modifiez ensuite un détail et relancez. Expérimenter ne prend que quelques minutes, et cela vous montre à quel point un bon prompt change le résultat. Parcourez le catalogue complet sur picassoia.com/en/all-models et créez dès aujourd’hui votre première image.