Prix de Claude Opus 5.5 : coût de l’API et accès gratuit

Claude Opus 5.5 est facturé 4 $ par million de tokens en entrée et 20 $ par million de tokens en sortie, avec des lectures de cache à 0,20 $ et une remise de 50 % sur l’API Batch. Découvrez ce que coûtent réellement les conversations, les relectures de code et les agents, comment il se compare à Opus 5, Sonnet 5.5 et Haiku 4.5, quels forfaits l’incluent et où s’arrête l’accès gratuit.

Prix de Claude Opus 5.5 : coût de l’API et accès gratuit
Cristian Da Conceicao
Fondateur de Picasso IA

Claude Opus 5.5 coûte 4 $ par million de tokens en entrée et 20 $ par million de tokens en sortie sur l’API d’Anthropic. C’est 20 % de moins que Claude Opus 5, facturé 5 $ et 25 $, et chaque ligne de votre facture se construit à partir de ces deux chiffres. Une réponse courte dans une conversation coûte environ deux centimes. Un service d’assistance client très sollicité atteint près de quatre cents dollars par mois. Quant à la solution gratuite que beaucoup recherchent, elle comporte une limite stricte que la plupart des pages « Opus gratuit » passent sous silence. Voici des chiffres réels pour les trois cas, afin que vous puissiez estimer votre propre facture avant d’écrire la moindre ligne de code.

Un développeur indépendant étudie une feuille imprimée à une table de café près d’une fenêtre pluvieuse

Le prix en un tableau

Anthropic facture Claude au token, et chaque tarif ci-dessous s’entend par million de tokens (MTok). Un token correspond à peu près à quatre caractères en anglais : 1 000 tokens représentent environ 750 mots, et un rapport de 10 pages pèse environ 7 000 tokens.

Tarifs par million de tokens

ÉlémentPrix par million de tokens
Entrée, standard4,00 $
Sortie, standard20,00 $
Lecture depuis le cache0,20 $
Écriture dans le cache, 5 minutes5,00 $
Écriture dans le cache, 1 heure8,00 $
Entrée Batch2,00 $
Sortie Batch10,00 $
Mode rapide, entrée et sortie8,00 $ et 40,00 $

Quatre autres éléments façonnent la facture :

  • Identifiant du modèle : claude-opus-5-5
  • Fenêtre de contexte : 1 million de tokens
  • Sortie maximale : 128 000 tokens par réponse
  • Priority Tier : non proposé pour ce modèle

La formule est simple : (tokens d’entrée × 4 + tokens de sortie × 20) ÷ 1 000 000 donne le coût en dollars. Une requête de 10 000 tokens en entrée et 1 000 tokens en sortie coûte 0,04 $ plus 0,02 $, soit six centimes. Chaque réponse de l’API indique le nombre exact de tokens d’entrée et de sortie dans ses données d’utilisation : consignez ces valeurs pour chaque requête, puis multipliez. Les équipes qui sautent cette étape ont tendance à sous-estimer la sortie, qui est le poste le plus cher.

💡 La sortie coûte cinq fois plus cher que l’entrée. Une longue réponse pèse bien plus sur la facture qu’un long prompt, alors définissez une limite max_tokens raisonnable sur chaque requête.

Vue de dessus d’un bureau avec une calculatrice, des pièces, un carnet et un café

Les tokens de réflexion sont aussi facturés

Opus 5.5 réfléchit toujours avant de répondre. Vous ne pouvez pas désactiver cette réflexion, et les tokens de raisonnement sont facturés au tarif de sortie, soit 20 $ par million. Le niveau d’effort par défaut est medium. Une question de programmation complexe à haut niveau d’effort peut consommer des milliers de tokens de réflexion avant le premier mot visible, de sorte qu’une réponse de 500 mots peut être facturée pour bien plus de tokens de sortie que ce que vous voyez.

Deux autres détails modifient les anciennes estimations. Opus 5.5 utilise le tokeniseur introduit avec Opus 4.7, qui peut produire jusqu’à environ 35 % de tokens en plus que les anciens modèles Claude pour le même texte. Si votre budget repose sur les chiffres de Claude 4.6, recalculez avec le point de terminaison de comptage des tokens avant de vous y fier.

Le coût réel des charges de travail

Les tarifs ne veulent pas dire grand-chose tant qu’on ne les rattache pas à une tâche. Chaque chiffre de cette section utilise les tarifs standard de 4 $ et 20 $, sans cache ni remise Batch.

Conversations, brouillons et relectures de code

TâcheTokens d’entréeTokens de sortieCoût
Une réponse de conversation2 0008000,024 $
Brouillon d’article de 2 500 mots1 5003 3000,072 $
Relecture d’une demande de fusion30 0003 0000,18 $
Relecture d’un long contrat200 0004 0000,88 $

Même la relecture de contrat, avec 200 000 tokens en entrée, reste sous le dollar. La surprise vient rarement d’un seul appel. Elle vient des milliers d’appels que personne n’a comptés, et des tokens de réflexion qui accompagnent chacun d’eux.

Les sessions d’agents s’additionnent vite

Un agent qui modifie des fichiers et lance des tests relit son contexte, qui grandit, à chaque étape. Imaginez une session de 40 étapes qui consomme 500 000 tokens en entrée au total et produit 40 000 tokens en sortie :

  • Entrée : 500 000 tokens × 4 $ par million = 2,00 $
  • Sortie : 40 000 tokens × 20 $ par million = 0,80 $
  • Total : 2,80 $

Mettez maintenant en cache le contexte répété, de sorte que 90 % des entrées soient lues depuis le cache. Les 450 000 tokens en cache coûtent 0,09 $, les 50 000 tokens frais coûtent 0,20 $, et la sortie reste à 0,80 $. La session tombe à environ 1,09 $, plus une écriture unique dans le cache lors de la première requête.

Budgétez un mois avant de commencer

Une méthode rapide limite les mauvaises surprises :

  1. Lancez 50 requêtes réelles et notez la moyenne des tokens d’entrée et de sortie.
  2. Multipliez par votre volume mensuel prévu.
  3. Ajoutez 30 % pour les nouvelles tentatives, les conversations plus longues et les variations de réflexion.
  4. N’appliquez les remises de cache ou Batch qu’au trafic qui y est réellement éligible.

Essayez avec une application qui envoie 20 000 requêtes par mois, à 3 000 tokens en entrée et 700 en sortie chacune. L’entrée représente 60 millions de tokens, soit 240 $. La sortie représente 14 millions de tokens, soit 280 $. La facture de base s’élève à 520 $, et la marge de 30 % porte le chiffre de planification à 676 $.

Trois bocaux en verre contenant des quantités très différentes de pièces de cuivre

Opus 5.5 face aux autres

Moins cher qu’Opus 5

Opus 5.5 facture 4 $ et 20 $ là où Opus 5 facture 5 $ et 25 $, soit une baisse de 20 % des deux côtés. Les lectures de cache passent de 0,50 $ à 0,20 $ par million de tokens, soit une baisse de 60 %. La fenêtre de contexte, le plafond de sortie et le tokeniseur restent identiques : pour une équipe déjà sur Opus 5, la seule baisse de prix suffit à justifier un test du changement. Une équipe qui dépense 5 000 $ par mois sur Opus 5 paierait environ 4 000 $ pour le même volume de tokens sur Opus 5.5, soit une économie de 1 000 $ par mois, ou 12 000 $ par an, avant toute remise de cache ou Batch.

Vérifiez d’abord deux changements incompatibles : la réflexion ne peut pas être désactivée sur Opus 5.5, et forcer un outil précis avec tool_choice renvoie une erreur. Le code écrit pour les anciens modèles Opus peut nécessiter de petites modifications.

Pour comparer la famille de manière équitable, prenez une seule charge de travail : un service d’assistance qui répond à 1 000 tickets par jour, avec 1 500 tokens en entrée et 400 en sortie chacun, sur 30 jours.

ModèleEntrée et sortie par MTokFacture mensuelle
Claude Fable 5.110 $ et 50 $1 050 $
Claude Opus 55 $ et 25 $525 $
Claude Opus 5.54 $ et 20 $420 $
Claude Sonnet 5.52 $ et 10 $210 $
Claude Haiku 4.51 $ et 5 $105 $

Sur cette charge de travail, Opus 5.5 coûte 105 $ de moins qu’Opus 5 chaque mois, et un traitement Batch le ramènerait à 210 $.

Quand Sonnet ou Haiku l’emporte

Le prix par appel n’est pas le prix d’une tâche terminée. Un modèle moins cher qui nécessite deux nouvelles tentatives coûte plus cher qu’un modèle plus performant qui réussit du premier coup. Pourtant, la répartition est claire en pratique :

  • Opus 5.5 : longues exécutions d’agents, débogage complexe, raisonnement de niveau contractuel.
  • Claude Sonnet 5.5 à 2 $ et 10 $ : programmation courante, rédaction et conversations, à moitié prix d’Opus.
  • Claude Haiku 4.5 à 1 $ et 5 $ : classification, routage et étiquetage en volume.

Testez vos propres prompts sur les trois, puis comparez le coût par résultat correct plutôt que le coût par requête.

Deux développeurs qui programment en binôme sur un bureau debout partagé

Trois façons de réduire la facture

Le cache de prompt se rentabilise vite

Imaginons que vous posiez dix questions sur le même contrat de 100 000 tokens. Sans cache, chaque requête paie 0,40 $ pour cette entrée : 4,00 $ au total pour dix. Avec un cache de 5 minutes, la première requête écrit le contrat à 5 $ par million (0,50 $), et les neuf suivantes le lisent à 0,20 $ par million (0,02 $ chacune). Le total en entrée s’élève à 0,68 $.

Placez en premier le contenu stable (instructions, documents, définitions d’outils) et la question variable en dernier, car le cache fonctionne sur un préfixe exact. Un seul mot modifié près du début invalide tout ce qui suit.

Les traitements par lots coûtent deux fois moins

L’API Batch prend les requêtes en masse et renvoie les résultats de façon asynchrone, généralement sous un jour, à 50 % des tarifs standard : 2 $ en entrée et 10 $ en sortie par million de tokens. Tout ce que personne n’attend est éligible : synthèses nocturnes, descriptions de catalogue, étiquetage de jeux de données, évaluations. L’exemple du service d’assistance passe de 420 $ à 210 $ par mois si les réponses peuvent attendre, et Batch peut se combiner avec le cache pour une baisse plus forte.

Une salle de tri de colis à l’aube avec des rangées de chariots chargés

Baisser le niveau d’effort

L’effort est le levier le moins coûteux, car il réduit les tokens de réflexion sans toucher au prompt. La valeur par défaut sur Opus 5.5 est medium. Les conversations, les réécritures courtes et l’extraction simple ont rarement besoin de plus de low, tandis que les refactorisations sur plusieurs fichiers et le débogage délicat méritent high. Mesurez sur un échantillon de vos requêtes réelles avant de changer une valeur par défaut, et associez ce réglage à un plafond max_tokens.

💡 Le mode rapide double le prix. Il fait tourner le même modèle à jusqu’à 2,5 fois la vitesse de sortie, pour 8 $ en entrée et 40 $ en sortie par million de tokens. Il s’agit d’un aperçu de recherche, disponible uniquement sur l’API d’Anthropic, et il ne peut pas être combiné avec l’API Batch. Ne l’utilisez que lorsqu’une personne attend devant l’écran.

Accès gratuit : ce qui est réel

Soyons directs. En date de début octobre 2026, il n’existe aucune offre gratuite pour Opus 5.5 sur l’API, et le forfait gratuit de claude.ai ne l’inclut pas. Chaque solution qui fonctionne a un coût ou une contrepartie qu’il vaut la peine de connaître.

La limite du forfait gratuit

Le forfait gratuit de Claude vous donne accès à une conversation avec des modèles de la classe Sonnet et Haiku, dans la limite de quotas d’utilisation quotidiens. Opus 5.5 est réservé à un forfait payant. Cela correspond au fonctionnement de l’API : paiement à l’usage dès la première requête, avec des crédits prépayés et aucune allocation gratuite permanente. Les forfaits et les limites changent souvent, alors consultez la page des forfaits sur le site de Claude avant de payer quoi que ce soit.

Une étudiante travaillant sur un ordinateur portable dans une bibliothèque ancienne et calme

Les forfaits payants qui incluent Opus

Claude Pro coûte 20 $ par mois et Claude Max commence à 100 $ par mois. Les deux donnent accès aux modèles Opus dans l’application de conversation, avec des limites d’utilisation plutôt qu’une facturation au token. Pour une comparaison approximative : aux tarifs de l’API, 20 $ permettent d’obtenir environ 830 réponses de conversation de la taille évoquée plus haut (2 000 tokens en entrée, 800 en sortie). Un utilisateur occasionnel s’en sort généralement mieux avec un forfait, tandis qu’une application qui effectue des milliers d’appels a besoin de l’API.

Les crédits cloud sont l’autre remise légitime. Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry proposent tous Claude, et une entreprise qui dispose déjà de crédits auprès de l’un d’eux peut les dépenser là-bas. Bedrock et Vertex AI publient leurs propres tarifs : vérifiez-les plutôt que de supposer que les chiffres de cet article s’appliquent.

Une femme qui lit sur un ordinateur portable à une table de cuisine ensoleillée

Les sites qui promettent Opus gratuit

Si vous cherchez Opus 5.5 gratuit, vous trouverez des pages qui promettent un accès illimité sans inscription. Méfiez-vous. Beaucoup sont des surcouches qui revendent un petit quota, certaines vous redirigent vers un modèle moins cher sans le dire, et d’autres collectent tout ce que vous collez. N’envoyez jamais de contrats, de code source ou de données clients par un site que vous ne pouvez pas vérifier. Quelques centimes par requête sur l’API officielle coûtent moins cher qu’une fuite.

Si vous n’avez besoin de réponses de niveau Opus que quelques fois par semaine, le chemin honnête le moins cher consiste en un petit solde prépayé sur l’API. À environ 2,4 centimes par réponse de conversation, chaque tranche de 10 $ achète environ 400 réponses de la taille évoquée plus haut.

En bref :

  • Offre gratuite pour Opus 5.5 sur l’API : non
  • Opus 5.5 sur le forfait gratuit de claude.ai : non, en date de début octobre 2026
  • Prix mensuel fixe pour l’accès à la conversation : à partir de 20 $
  • Remises les plus importantes sur l’API : le cache et Batch
  • Modèles de texte gratuits à essayer à la place : les modèles ouverts du catalogue PicassoIA

Utiliser Claude sur PicassoIA

Opus 5.5 lui-même ne figure pas dans le catalogue PicassoIA au moment de la rédaction. Le modèle Opus le plus proche est Claude Opus 4.7, et la même collection référence Claude Fable 5, Claude Sonnet 5, Claude Sonnet 4.6 et Claude 4.5 Haiku. Vous ouvrez une page, vous tapez, et vous lisez la réponse. Il n’y a ni compte développeur à configurer, ni tableau de bord de facturation à surveiller.

Ouvrir la page du modèle

  1. Ouvrez la page de Claude Opus 4.7 dans la collection des grands modèles de langage.
  2. Saisissez votre question dans la zone Prompt. Collez du code, un brouillon ou un long document.
  3. Importez éventuellement une image, par exemple une capture d’écran de facture ou un schéma.
  4. Lancez le modèle et lisez la réponse.

Régler le prompt et les limites

RéglageValeur par défautCe qu’il fait
PromptObligatoireVotre question ou tâche
System PromptVideDéfinit le rôle, le ton et les règles de format
Max Tokens8 192Limite la longueur de la réponse
ImageAucuneAjoute une capture d’écran ou une photo
Max Image Resolution0,5 mégapixelRéduit l’image avant l’envoi, ce qui économise du temps et de l’argent

Trois bonnes habitudes améliorent les réponses. Donnez un rôle dans le system prompt, par exemple « Vous êtes un relecteur attentif de pages de tarifs. » Demandez un tableau lorsque vous voulez une comparaison. Baissez Max Tokens lorsque vous n’avez besoin que d’une réponse brève.

💡 Vous voulez un coût nul ? Le catalogue propose aussi des modèles ouverts comme GPT OSS 120B et Llama 4 Maverick Instruct, tous deux présentés comme gratuits à essayer. La qualité et les limites diffèrent d’Opus, alors testez-les sur vos propres prompts.

Gros plan de mains tapant sur un ordinateur portable posé sur un bureau en bois

Associer Claude aux images et à la vidéo

Un modèle de langage a aussi sa place dans un flux de travail visuel. Demandez à Claude vingt prompts d’image détaillés d’environ 120 mots chacun. Cela représente environ 3 200 tokens de sortie, soit à peu près 6 centimes au tarif de sortie d’Opus 5.5, et les prompts contiennent les détails de l’objectif, de la lumière et de la texture qui donnent aux photos générées un rendu réaliste.

Une requête qui fonctionne bien ressemble à ceci : « Rédigez un prompt photographique de 70 mots pour une scène de cuisine au petit matin. Incluez le sujet, l’environnement, la direction de la lumière, l’objectif de l’appareil et deux textures de surface. Aucun texte dans l’image. » Claude renvoie un paragraphe dense que vous pouvez coller directement dans un modèle d’image, et une seconde passe ne coûte que quelques centimes de plus.

Passez ensuite aux modèles d’image et de vidéo de PicassoIA :

  • Images : collez le prompt dans Seedream 4.5 ou P-Image pour des images fixes photoréalistes.
  • Vidéo : utilisez une image fixe comme première image dans Seedance 2.5 Lite ou PicassoIA Video. La fiche de Seedance 2.5 Lite le présente comme un générateur gratuit et illimité de clips allant jusqu’à 10 secondes.
  • Itérez : renvoyez le résultat à Claude, demandez ce qu’il faut modifier, puis relancez.

Utiliser un outil pour les mots et un autre pour les images permet de garder chaque coût visible. Vous payez quelques centimes pour le prompt, et vous laissez le modèle d’image ou de vidéo faire le gros du travail.

Une directrice artistique dans un atelier en loft face à un écran affichant une photo de lac de montagne

Créer vos premières images sur PicassoIA

Vous connaissez maintenant le prix d’Opus 5.5, le point où s’arrêtent les voies gratuites, et trois façons d’optimiser chaque token. Le plus rapide pour mettre tout cela en pratique, c’est de passer à la pratique. Ouvrez PicassoIA, demandez à un modèle Claude de rédiger un prompt photographique pour une scène qui vous tient à cœur, puis lancez-le dans Seedream 4.5. Prenez ensuite la meilleure image et confiez-la à un modèle vidéo pour la voir bouger. Parcourez le reste sur tous les modèles PicassoIA, et continuez d’expérimenter jusqu’à ce que les prompts vous ressemblent.

Partager cet article

Choisissez votre langue