Tarifs de Claude Agent SDK : abonnement, crédits et coûts

L’usage de l’Agent SDK peut puiser dans les limites du forfait, dans les crédits API mensuels ajoutés aux forfaits Max et Team le 7 octobre, ou dans la facturation au token. Cet article détaille chaque prix, les montants de crédits, les économies du cache et le coût chiffré d’un run d’agent.

Tarifs de Claude Agent SDK : abonnement, crédits et coûts
Cristian Da Conceicao
Fondateur de Picasso IA

Le Claude Agent SDK n’a pas de prix propre. La facture vient du modèle qui le fait tourner, et à la date du 8 octobre 2026, elle peut vous parvenir de trois façons : via vos limites d’abonnement, via les nouveaux crédits API mensuels des forfaits Max et Team, ou via la facturation classique au token. Choisissez la mauvaise voie et vous vous heurtez à un mur au milieu d’un run, ou vous payez plus que nécessaire. Cet article détaille chaque option avec les chiffres des pages tarifs et d’aide d’Anthropic, puis calcule ce que coûte un run d’agent unique sur trois modèles différents.

Un développeur en sweat gris qui travaille à un bureau debout dans un bureau à domicile calme

Comment le SDK est facturé

L’Agent SDK est une bibliothèque Python et TypeScript qui intègre la boucle d’agent de Claude Code, ses outils intégrés, ses sessions et ses hooks dans votre propre programme. La documentation d’Anthropic le décrit comme une bibliothèque qui exécute le binaire Claude Code dans un processus que vous gérez. Sa page tarifaire ne prévoit aucun frais pour le SDK : ce que vous payez, c’est l’usage du modèle, soit les tokens d’entrée, les tokens de sortie et l’activité du cache.

Trois façons de payer

La façon dont le SDK s’authentifie détermine où ces tokens sont facturés :

  • Limites d’abonnement. Le SDK utilise votre connexion Claude et puise dans la même enveloppe que vos conversations et votre codage interactif. Il n’y a pas de compteur en dollars, seulement des limites qui se réinitialisent.
  • Crédits API mensuels. Les forfaits Max et Team incluent désormais un montant en dollars à chaque cycle de facturation, que le SDK consomme aux tarifs API standard.
  • API au token. Vous achetez des crédits dans la Claude Console, créez un identifiant API, et chaque token est facturé au tarif public.
VoieFacturé enIdéal pourPoints de vigilance
Limites d’abonnementEnveloppe du forfaitScripts personnels et tâches nocturnesUn pool partagé avec vos conversations
Crédits mensuelsDollars qui expirentPrototypes et projets annexesPas de report en fin de cycle
Au tokenDollars que vous achetezProduits avec de vrais utilisateursAucun plafond sauf si vous en définissez un

💡 Les fournisseurs cloud forment une quatrième voie. Le SDK peut tourner sur Amazon Bedrock, Google Cloud ou Microsoft Foundry. Ces factures viennent du fournisseur cloud, et les crédits Max et Team ne s’y appliquent pas.

Pourquoi les anciens articles se contredisent

Les résultats de recherche regorgent d’affirmations contradictoires, car les règles ont changé trois fois cette année :

  • 13 mai : Anthropic a annoncé qu’à partir du 15 juin, l’Agent SDK, claude -p, Claude Code GitHub Actions et les applications tierces construites sur le SDK passeraient sur un crédit mensuel distinct, facturé aux tarifs API pleins : 20 $ sur Pro, 100 $ sur Max 5x et 200 $ sur Max 20x.
  • 15 juin : Anthropic a suspendu ce changement le jour même de son entrée en vigueur. L’usage de l’Agent SDK a continué de puiser dans les limites d’abonnement, et aucun crédit n’était à réclamer.
  • 7 octobre : les forfaits Max et Team ont reçu des crédits API mensuels incluant le SDK. Pro n’en a pas reçu.

Si un article indique que les abonnés Pro reçoivent un crédit SDK de 20 $, il décrit le forfait qui a été suspendu.

Limites d’abonnement ou crédits mensuels

Fonctionner avec les limites d’abonnement

L’article d’aide d’Anthropic sur le SDK indique que l’usage passant par votre connexion Claude continue de compter dans vos limites d’abonnement, comme claude -p. C’est la bonne voie pour l’automatisation personnelle : un script sur votre ordinateur portable, une tâche nocturne sur votre propre machine. Un abonnement coûte 20 $ par mois pour Pro, 100 $ pour Max 5x et 200 $ pour Max 20x, et vous ne payez rien par token.

Le piège, c’est le partage. Le SDK puise dans le même pool que chaque conversation et chaque session de codage interactif, si bien qu’une longue boucle d’agent peut vous laisser à court d’allocation pour le reste de la journée.

Trois cartes de papier crème vierges, disposées à des hauteurs croissantes sur un bureau en noyer

Les crédits Max et Team

Le 7 octobre 2026, Anthropic a ajouté des crédits API mensuels aux forfaits Max et Team. Ils s’appliquent à l’API Claude, à Claude Managed Agents, au Claude Agent SDK et au playground de la Console.

ForfaitCrédit mensuel
Max 5x100 $
Max 20x200 $
Team, siège Standard20 $ par siège
Team, siège Premium100 $ par siège
Free, Pro et EnterpriseNon éligibles

Un crédit se dépense aux tarifs API de la section suivante, donc 100 $ représentent 100 $ de tokens. Claude Code en mode interactif et l’usage supplémentaire dans les applications Claude sont exclus, et les crédits ne modifient pas vos limites d’abonnement.

Un sablier en laiton dont les derniers grains tombent à côté d’un calendrier papier vierge

Réclamer et dépenser les crédits

Les crédits ne sont pas attribués automatiquement. Suivez ces étapes :

  1. Sur claude.ai, ouvrez Settings > Billing avec un forfait Max, ou Organization settings > Billing avec un forfait Team.
  2. Dans la section API credits, choisissez l’organisation de la Claude Console qui doit les recevoir, puis acceptez les conditions du programme.
  3. Trouvez le solde dans la Console, sous Settings > Billing, dans la section Promotional credits.
  4. Créez un identifiant API dans cette organisation et configurez le SDK pour l’utiliser.

Quelques règles déterminent jusqu’où ira l’argent :

  • Les nouveaux abonnés peuvent réclamer après 7 jours sur un forfait éligible.
  • Chaque forfait est lié à une seule organisation de la Console, et vous ne pouvez pas modifier ce lien ensuite, donc choisissez l’organisation dans laquelle vous allez construire.
  • Les crédits inclus sont dépensés avant les crédits que vous avez achetés, et aucun moyen de paiement n’est requis sur Claude Platform.
  • Les crédits non utilisés expirent à la fin de chaque cycle de facturation (mensuel pour les forfaits annuels) et ne sont jamais reportés.
  • Quand le solde atteint zéro et qu’aucune autre ressource n’est disponible, les requêtes s’arrêtent jusqu’à l’arrivée du prochain lot. L’usage n’est jamais facturé sur votre forfait Claude. L’erreur affiche Your credit balance is too low to access the Anthropic API.

Prix des tokens modèle par modèle

La grille tarifaire actuelle

Ce sont les tarifs publics par million de tokens, tirés de la page tarifaire d’Anthropic, vérifiés le 8 octobre 2026.

ModèleEntréeSortieLecture du cache
Claude Fable 5.110 $50 $0,25 $
Claude Opus 5.54 $20 $0,20 $
Claude Sonnet 5.52 $10 $0,10 $
Claude Sonnet 52 $10 $0,20 $
Claude Haiku 5.5 (prompts jusqu’à 100 000 tokens)0,10 $0,50 $0,01 $
Claude Haiku 4.51 $5 $0,10 $

Claude Haiku 5.5 coûte plus cher quand un prompt dépasse 100 000 tokens : 0,50 $ en entrée et 2,50 $ en sortie.

💡 Claude Sonnet 5 a été lancé avec 2 $ et 10 $ comme tarifs de lancement jusqu’au 31 août 2026. La page d’Anthropic indique désormais que ce sont les tarifs standard et que la hausse prévue au 1er septembre, à 3 $ et 15 $, n’aura pas lieu. Toute page qui mentionne encore cette hausse est périmée.

Les modèles à partir de la version 4.7 utilisent un tokenizer plus récent qui produit environ 30 % de tokens en plus pour le même texte que la génération 4.6 et les précédentes. Comparez le coût d’une tâche terminée, et pas seulement le prix par token.

Trois pièces d’échecs en bois de taille croissante sur un bureau en noyer sombre, à côté d’un ordinateur portable

Les lectures du cache coûtent moins cher

Le SDK active le cache de prompts automatiquement. Une écriture dans le cache de 5 minutes coûte 1,25 fois le prix de base de l’entrée, une écriture de 1 heure coûte 2 fois, et une lecture du cache coûte 0,1 fois. Sur Opus 5.5 et Sonnet 5.5, la lecture coûte 0,05 fois, et sur Fable 5.1, 0,025 fois. Une boucle d’agent renvoie un long préfixe stable à chaque étape, donc la plupart de ses tokens d’entrée finissent en lectures bon marché.

Avec un identifiant API, le cache dure 5 minutes par défaut. Si vos exécutions sont espacées au-delà, définissez la variable d’environnement ENABLE_PROMPT_CACHING_1H. L’option de 1 heure coûte plus cher à l’écriture et se rentabilise lorsque les exécutions suivantes lisent le même préfixe.

Une main qui ouvre un tiroir en bois d’un meuble à fiches de bibliothèque

Les multiplicateurs cachés à surveiller

Les tokens ne constituent pas toute la facture. Vérifiez ces points avant de budgétiser :

  • Recherche web : 10 $ pour 1 000 recherches sur l’API Claude, en plus des tokens. La récupération web n’ajoute rien au-delà des tokens qu’elle apporte.
  • Inférence réservée aux États-Unis : un multiplicateur de 1,1 sur chaque catégorie de tokens lorsque vous définissez inference_geo: "us" sur Claude 4.6 et les modèles ultérieurs.
  • Points de terminaison cloud régionaux : sur Bedrock et Google Cloud, les points de terminaison régionaux et multirégionaux coûtent 10 % de plus que les points globaux.
  • Mode rapide : Opus 5.5 fonctionne à 8 $ en entrée et 40 $ en sortie par million de tokens en préversion de recherche, soit le double du tarif standard.
  • API Batch : 50 % de réduction sur l’entrée et la sortie, mais elle convient aux tâches hors ligne envoyées directement à l’API, pas à une boucle SDK interactive.

Ce que coûte un run d’agent

Le cadre

Imaginez une exécution de correction de bug : l’agent lit quelques fichiers, modifie le code, lance les tests et répète l’opération pendant environ 30 étapes. Supposons 600 000 tokens d’entrée au total sur ces étapes, répartis entre 20 000 tokens non mis en cache, 40 000 écrits dans le cache de 5 minutes et 540 000 relus depuis ce cache, auxquels s’ajoutent 30 000 tokens de sortie. Ce sont des chiffres illustratifs, pas une mesure, mais ils ont la forme d’une boucle d’agent avec cache.

Vue de dessus d’une main qui dessine des barres sur du papier quadrillé, à côté d’une calculatrice usée

Le résultat

Sur Sonnet 5.5, le calcul est le suivant :

  • 20 000 tokens d’entrée non mis en cache × 2 $ par million = 0,04 $
  • 40 000 tokens d’écriture en cache × 2,50 $ par million = 0,10 $
  • 540 000 tokens de lecture du cache × 0,10 $ par million = 0,054 $
  • 30 000 tokens de sortie × 10 $ par million = 0,30 $

Cela fait au total 0,494 $. Avec la même forme de run sur trois modèles, un crédit de 100 $ achète des volumes de travail très différents :

ModèleCoût par runRuns avec un crédit de 100 $
Claude Haiku 5.5environ 0,03 $plus de 3 600
Claude Sonnet 5.5environ 0,49 $environ 200
Claude Opus 5.5environ 0,99 $environ 100

Deux enseignements ressortent. D’abord, le cache fait économiser environ les deux tiers : le même run sur Sonnet 5.5 sans cache coûterait 1,50 $. Ensuite, la sortie est la partie coûteuse. Ces 30 000 tokens de sortie représentent environ 5 % du volume et 61 % du coût. Un crédit Max 20x double simplement chaque chiffre de la dernière colonne.

Suivre les dépenses dans le SDK

Lire l’estimation de coût

Chaque appel query() se termine par un message de résultat qui contient total_cost_usd, le coût estimé de cet appel. Le champ modelUsage le détaille par modèle, y compris les lectures et écritures du cache. Trois détails induisent souvent en erreur :

  • total_cost_usd et modelUsage incluent le travail des sous-agents, mais usage les exclut, donc usage sous-estime dès que des sous-agents tournent.
  • Les appels d’outils parallèles produisent plusieurs messages d’assistant qui partagent un même ID. Comptez chaque ID une seule fois.
  • Le output_tokens de chaque étape est un espace réservé. Lisez le nombre réel de tokens de sortie dans le message de résultat.

💡 total_cost_usd est une estimation côté client, calculée à partir d’une grille tarifaire fournie avec le SDK. Anthropic recommande d’utiliser l’Usage and Cost API ou la page Usage de la Console pour la facturation de référence, et de ne jamais facturer vos clients à partir de cette estimation.

import { query } from "@anthropic-ai/claude-agent-sdk";

for await (const message of query({
  prompt: "Fix the failing test in src/auth.ts",
  options: { maxBudgetUsd: 2 },
})) {
  if (message.type === "result") {
    console.log(message.subtype, message.total_cost_usd);
  }
}

Un compteur électrique analogique usé sur un mur de briques rouges

Plafonner un run

L’option maxBudgetUsd en TypeScript, ou max_budget_usd en Python, interrompt un appel dès que sa propre dépense dépasse la limite. Elle ne compte que cet appel : les dépenses restaurées depuis une session reprise ne lui sont pas imputées, et un /clear remet le budget à zéro. Le résultat arrive alors avec le sous-type error_max_budget_usd.

Pour un plafond sur l’ensemble d’un projet, donnez-lui son propre espace de travail dans la Console et définissez la limite de dépenses de cet espace. Chaque identifiant et chaque espace de travail d’une organisation liée puisent dans le même solde de crédits, si bien qu’une limite d’espace de travail empêche un job bruyant de consommer l’allocation du mois.

Équipes, produits et agents managés

Fonctionnement des pools d’équipe

Les crédits Team sont de 20 $ par siège Standard et 100 $ par siège Premium, regroupés en un solde unique plafonné à 500 $ par mois. Une équipe avec trois sièges Standard et deux sièges Premium reçoit 260 $ par mois, et l’ajout d’un siège Premium porte le crédit du mois suivant à 360 $. Le montant dépend des sièges du forfait au début de chaque cycle mensuel. Lier une organisation la place aussi au moins au niveau d’usage Start, ou au niveau Build lorsque le crédit mensuel dépasse 200 $.

Quatre collègues autour d’une table en bois dans un espace de coworking lumineux

Construire pour des clients

Si vous lancez un produit, prévoyez une facturation API. Anthropic n’autorise pas les développeurs tiers à proposer la connexion claude.ai ni ses limites de débit dans leurs produits, y compris les agents construits sur le SDK, sauf approbation préalable d’Anthropic. Les crédits mensuels sont destinés à construire et faire tourner vos propres applications et agents : gardez donc le trafic client sur la facturation au token, où vous contrôlez les limites de dépenses par espace de travail.

Comparaison avec les agents managés

Claude Managed Agents est l’alternative hébergée : Anthropic fait tourner la boucle d’agent dans un bac à sable cloud qu’il gère. Elle facture les mêmes tarifs de tokens plus 0,08 $ par heure de session, comptée uniquement pendant que la session tourne. Le temps d’inactivité ne compte pas. Une session d’une heure sur Sonnet 5.5 avec 50 000 tokens d’entrée et 15 000 tokens de sortie coûte 0,10 $ + 0,15 $ + 0,08 $, soit 0,33 $. Avec le SDK, il n’y a pas de poste d’exécution, mais la machine sur laquelle il tourne est à votre charge. Les crédits Max et Team fonctionnent sur les deux.

Utiliser Claude Sonnet 5 sur PicassoIA

Avant de dépenser des crédits pour mettre au point un agent, rédigez et testez son prompt système dans un modèle de chat. Claude Sonnet 5 est disponible sur PicassoIA, conçu pour le codage en plusieurs étapes et l’usage d’outils, ce qui en fait un endroit pratique pour tester un prompt avant de le brancher sur le SDK.

Une jeune femme qui tape sur un ordinateur portable, assise près d’une fenêtre dans un café calme

  1. Ouvrez la page Claude Sonnet 5 dans la collection Large Language Models.
  2. Collez la tâche dans Prompt, puis placez le rôle et les règles dans System Prompt.
  3. Réglez Effort. La valeur par défaut, low, désactive la réflexion pour des réponses plus rapides et moins chères. Montez ensuite par paliers : medium, high, xhigh puis max pour un bug qui touche plusieurs fichiers.
  4. Laissez Max Tokens à 8 192, sauf si vous attendez une réponse plus longue.
  5. Joignez une capture d’écran dans Image si la tâche part d’un écran d’erreur. Max Image Resolution vaut 0,5 mégapixel par défaut, et une image compte pour largeur × hauteur ÷ 750 tokens d’entrée.
  6. Lancez, ajustez la formulation, puis copiez la version qui fonctionne dans vos options du SDK.

💡 L’échelle d’effort modifie aussi votre facture SDK. Un effort plus élevé produit plus de tokens de sortie, et la sortie est le côté coûteux de chaque grille tarifaire ci-dessus.

Pour comparer la façon dont un modèle plus léger ou plus lourd répond au même prompt, Claude Haiku 4.5, Claude Opus 4.7 et Claude Fable 5 figurent dans la même collection.

Créer vos propres images sur PicassoIA

Chaque photo de cet article provient de P Image, un modèle texte vers image de PicassoIA qui renvoie une image finie en moins d’une seconde. Il accepte les formats 16:9, 1:1, 9:16 et des tailles personnalisées, propose l’amélioration automatique du prompt pour les idées courtes, et accepte un seed pour reproduire exactement un résultat qui vous plaît.

Essayez dès maintenant. Décrivez une scène en une seule phrase, par exemple un bureau, une fenêtre et une lumière de fin d’après-midi. Lancez, modifiez un seul détail, puis relancez. Dix essais prennent quelques minutes, et à la fin vous aurez une idée de la façon dont les mots de cadrage, de lumière et de texture façonnent une photo.

PicassoIA propose aussi 91 modèles texte vers image et 87 modèles texte vers vidéo, ainsi que des modèles de musique, de parole et de langage, le tout dans la liste complète des modèles. Choisissez-en un, saisissez un prompt et créez quelque chose qui vous ressemble dès aujourd’hui.

Partager cet article

Choisissez votre langue