Claude Opus 5.5 coûte 4 $ par million de tokens en entrée et 20 $ par million de tokens en sortie sur l’API d’Anthropic. C’est 20 % de moins que Claude Opus 5, facturé 5 $ et 25 $, et chaque ligne de votre facture se construit à partir de ces deux chiffres. Une réponse courte dans une conversation coûte environ deux centimes. Un service d’assistance client très sollicité atteint près de quatre cents dollars par mois. Quant à la solution gratuite que beaucoup recherchent, elle comporte une limite stricte que la plupart des pages « Opus gratuit » passent sous silence. Voici des chiffres réels pour les trois cas, afin que vous puissiez estimer votre propre facture avant d’écrire la moindre ligne de code.

Le prix en un tableau
Anthropic facture Claude au token, et chaque tarif ci-dessous s’entend par million de tokens (MTok). Un token correspond à peu près à quatre caractères en anglais : 1 000 tokens représentent environ 750 mots, et un rapport de 10 pages pèse environ 7 000 tokens.
Tarifs par million de tokens
| Élément | Prix par million de tokens |
|---|
| Entrée, standard | 4,00 $ |
| Sortie, standard | 20,00 $ |
| Lecture depuis le cache | 0,20 $ |
| Écriture dans le cache, 5 minutes | 5,00 $ |
| Écriture dans le cache, 1 heure | 8,00 $ |
| Entrée Batch | 2,00 $ |
| Sortie Batch | 10,00 $ |
| Mode rapide, entrée et sortie | 8,00 $ et 40,00 $ |
Quatre autres éléments façonnent la facture :
- Identifiant du modèle :
claude-opus-5-5
- Fenêtre de contexte : 1 million de tokens
- Sortie maximale : 128 000 tokens par réponse
- Priority Tier : non proposé pour ce modèle
La formule est simple : (tokens d’entrée × 4 + tokens de sortie × 20) ÷ 1 000 000 donne le coût en dollars. Une requête de 10 000 tokens en entrée et 1 000 tokens en sortie coûte 0,04 $ plus 0,02 $, soit six centimes. Chaque réponse de l’API indique le nombre exact de tokens d’entrée et de sortie dans ses données d’utilisation : consignez ces valeurs pour chaque requête, puis multipliez. Les équipes qui sautent cette étape ont tendance à sous-estimer la sortie, qui est le poste le plus cher.
💡 La sortie coûte cinq fois plus cher que l’entrée. Une longue réponse pèse bien plus sur la facture qu’un long prompt, alors définissez une limite max_tokens raisonnable sur chaque requête.

Les tokens de réflexion sont aussi facturés
Opus 5.5 réfléchit toujours avant de répondre. Vous ne pouvez pas désactiver cette réflexion, et les tokens de raisonnement sont facturés au tarif de sortie, soit 20 $ par million. Le niveau d’effort par défaut est medium. Une question de programmation complexe à haut niveau d’effort peut consommer des milliers de tokens de réflexion avant le premier mot visible, de sorte qu’une réponse de 500 mots peut être facturée pour bien plus de tokens de sortie que ce que vous voyez.
Deux autres détails modifient les anciennes estimations. Opus 5.5 utilise le tokeniseur introduit avec Opus 4.7, qui peut produire jusqu’à environ 35 % de tokens en plus que les anciens modèles Claude pour le même texte. Si votre budget repose sur les chiffres de Claude 4.6, recalculez avec le point de terminaison de comptage des tokens avant de vous y fier.
Le coût réel des charges de travail
Les tarifs ne veulent pas dire grand-chose tant qu’on ne les rattache pas à une tâche. Chaque chiffre de cette section utilise les tarifs standard de 4 $ et 20 $, sans cache ni remise Batch.
Conversations, brouillons et relectures de code
| Tâche | Tokens d’entrée | Tokens de sortie | Coût |
|---|
| Une réponse de conversation | 2 000 | 800 | 0,024 $ |
| Brouillon d’article de 2 500 mots | 1 500 | 3 300 | 0,072 $ |
| Relecture d’une demande de fusion | 30 000 | 3 000 | 0,18 $ |
| Relecture d’un long contrat | 200 000 | 4 000 | 0,88 $ |
Même la relecture de contrat, avec 200 000 tokens en entrée, reste sous le dollar. La surprise vient rarement d’un seul appel. Elle vient des milliers d’appels que personne n’a comptés, et des tokens de réflexion qui accompagnent chacun d’eux.
Les sessions d’agents s’additionnent vite
Un agent qui modifie des fichiers et lance des tests relit son contexte, qui grandit, à chaque étape. Imaginez une session de 40 étapes qui consomme 500 000 tokens en entrée au total et produit 40 000 tokens en sortie :
- Entrée : 500 000 tokens × 4 $ par million = 2,00 $
- Sortie : 40 000 tokens × 20 $ par million = 0,80 $
- Total : 2,80 $
Mettez maintenant en cache le contexte répété, de sorte que 90 % des entrées soient lues depuis le cache. Les 450 000 tokens en cache coûtent 0,09 $, les 50 000 tokens frais coûtent 0,20 $, et la sortie reste à 0,80 $. La session tombe à environ 1,09 $, plus une écriture unique dans le cache lors de la première requête.
Budgétez un mois avant de commencer
Une méthode rapide limite les mauvaises surprises :
- Lancez 50 requêtes réelles et notez la moyenne des tokens d’entrée et de sortie.
- Multipliez par votre volume mensuel prévu.
- Ajoutez 30 % pour les nouvelles tentatives, les conversations plus longues et les variations de réflexion.
- N’appliquez les remises de cache ou Batch qu’au trafic qui y est réellement éligible.
Essayez avec une application qui envoie 20 000 requêtes par mois, à 3 000 tokens en entrée et 700 en sortie chacune. L’entrée représente 60 millions de tokens, soit 240 $. La sortie représente 14 millions de tokens, soit 280 $. La facture de base s’élève à 520 $, et la marge de 30 % porte le chiffre de planification à 676 $.

Opus 5.5 face aux autres
Moins cher qu’Opus 5
Opus 5.5 facture 4 $ et 20 $ là où Opus 5 facture 5 $ et 25 $, soit une baisse de 20 % des deux côtés. Les lectures de cache passent de 0,50 $ à 0,20 $ par million de tokens, soit une baisse de 60 %. La fenêtre de contexte, le plafond de sortie et le tokeniseur restent identiques : pour une équipe déjà sur Opus 5, la seule baisse de prix suffit à justifier un test du changement. Une équipe qui dépense 5 000 $ par mois sur Opus 5 paierait environ 4 000 $ pour le même volume de tokens sur Opus 5.5, soit une économie de 1 000 $ par mois, ou 12 000 $ par an, avant toute remise de cache ou Batch.
Vérifiez d’abord deux changements incompatibles : la réflexion ne peut pas être désactivée sur Opus 5.5, et forcer un outil précis avec tool_choice renvoie une erreur. Le code écrit pour les anciens modèles Opus peut nécessiter de petites modifications.
Pour comparer la famille de manière équitable, prenez une seule charge de travail : un service d’assistance qui répond à 1 000 tickets par jour, avec 1 500 tokens en entrée et 400 en sortie chacun, sur 30 jours.
| Modèle | Entrée et sortie par MTok | Facture mensuelle |
|---|
| Claude Fable 5.1 | 10 $ et 50 $ | 1 050 $ |
| Claude Opus 5 | 5 $ et 25 $ | 525 $ |
| Claude Opus 5.5 | 4 $ et 20 $ | 420 $ |
| Claude Sonnet 5.5 | 2 $ et 10 $ | 210 $ |
| Claude Haiku 4.5 | 1 $ et 5 $ | 105 $ |
Sur cette charge de travail, Opus 5.5 coûte 105 $ de moins qu’Opus 5 chaque mois, et un traitement Batch le ramènerait à 210 $.
Quand Sonnet ou Haiku l’emporte
Le prix par appel n’est pas le prix d’une tâche terminée. Un modèle moins cher qui nécessite deux nouvelles tentatives coûte plus cher qu’un modèle plus performant qui réussit du premier coup. Pourtant, la répartition est claire en pratique :
- Opus 5.5 : longues exécutions d’agents, débogage complexe, raisonnement de niveau contractuel.
- Claude Sonnet 5.5 à 2 $ et 10 $ : programmation courante, rédaction et conversations, à moitié prix d’Opus.
- Claude Haiku 4.5 à 1 $ et 5 $ : classification, routage et étiquetage en volume.
Testez vos propres prompts sur les trois, puis comparez le coût par résultat correct plutôt que le coût par requête.

Trois façons de réduire la facture
Le cache de prompt se rentabilise vite
Imaginons que vous posiez dix questions sur le même contrat de 100 000 tokens. Sans cache, chaque requête paie 0,40 $ pour cette entrée : 4,00 $ au total pour dix. Avec un cache de 5 minutes, la première requête écrit le contrat à 5 $ par million (0,50 $), et les neuf suivantes le lisent à 0,20 $ par million (0,02 $ chacune). Le total en entrée s’élève à 0,68 $.
Placez en premier le contenu stable (instructions, documents, définitions d’outils) et la question variable en dernier, car le cache fonctionne sur un préfixe exact. Un seul mot modifié près du début invalide tout ce qui suit.
Les traitements par lots coûtent deux fois moins
L’API Batch prend les requêtes en masse et renvoie les résultats de façon asynchrone, généralement sous un jour, à 50 % des tarifs standard : 2 $ en entrée et 10 $ en sortie par million de tokens. Tout ce que personne n’attend est éligible : synthèses nocturnes, descriptions de catalogue, étiquetage de jeux de données, évaluations. L’exemple du service d’assistance passe de 420 $ à 210 $ par mois si les réponses peuvent attendre, et Batch peut se combiner avec le cache pour une baisse plus forte.

Baisser le niveau d’effort
L’effort est le levier le moins coûteux, car il réduit les tokens de réflexion sans toucher au prompt. La valeur par défaut sur Opus 5.5 est medium. Les conversations, les réécritures courtes et l’extraction simple ont rarement besoin de plus de low, tandis que les refactorisations sur plusieurs fichiers et le débogage délicat méritent high. Mesurez sur un échantillon de vos requêtes réelles avant de changer une valeur par défaut, et associez ce réglage à un plafond max_tokens.
💡 Le mode rapide double le prix. Il fait tourner le même modèle à jusqu’à 2,5 fois la vitesse de sortie, pour 8 $ en entrée et 40 $ en sortie par million de tokens. Il s’agit d’un aperçu de recherche, disponible uniquement sur l’API d’Anthropic, et il ne peut pas être combiné avec l’API Batch. Ne l’utilisez que lorsqu’une personne attend devant l’écran.
Accès gratuit : ce qui est réel
Soyons directs. En date de début octobre 2026, il n’existe aucune offre gratuite pour Opus 5.5 sur l’API, et le forfait gratuit de claude.ai ne l’inclut pas. Chaque solution qui fonctionne a un coût ou une contrepartie qu’il vaut la peine de connaître.
La limite du forfait gratuit
Le forfait gratuit de Claude vous donne accès à une conversation avec des modèles de la classe Sonnet et Haiku, dans la limite de quotas d’utilisation quotidiens. Opus 5.5 est réservé à un forfait payant. Cela correspond au fonctionnement de l’API : paiement à l’usage dès la première requête, avec des crédits prépayés et aucune allocation gratuite permanente. Les forfaits et les limites changent souvent, alors consultez la page des forfaits sur le site de Claude avant de payer quoi que ce soit.

Les forfaits payants qui incluent Opus
Claude Pro coûte 20 $ par mois et Claude Max commence à 100 $ par mois. Les deux donnent accès aux modèles Opus dans l’application de conversation, avec des limites d’utilisation plutôt qu’une facturation au token. Pour une comparaison approximative : aux tarifs de l’API, 20 $ permettent d’obtenir environ 830 réponses de conversation de la taille évoquée plus haut (2 000 tokens en entrée, 800 en sortie). Un utilisateur occasionnel s’en sort généralement mieux avec un forfait, tandis qu’une application qui effectue des milliers d’appels a besoin de l’API.
Les crédits cloud sont l’autre remise légitime. Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry proposent tous Claude, et une entreprise qui dispose déjà de crédits auprès de l’un d’eux peut les dépenser là-bas. Bedrock et Vertex AI publient leurs propres tarifs : vérifiez-les plutôt que de supposer que les chiffres de cet article s’appliquent.

Les sites qui promettent Opus gratuit
Si vous cherchez Opus 5.5 gratuit, vous trouverez des pages qui promettent un accès illimité sans inscription. Méfiez-vous. Beaucoup sont des surcouches qui revendent un petit quota, certaines vous redirigent vers un modèle moins cher sans le dire, et d’autres collectent tout ce que vous collez. N’envoyez jamais de contrats, de code source ou de données clients par un site que vous ne pouvez pas vérifier. Quelques centimes par requête sur l’API officielle coûtent moins cher qu’une fuite.
Si vous n’avez besoin de réponses de niveau Opus que quelques fois par semaine, le chemin honnête le moins cher consiste en un petit solde prépayé sur l’API. À environ 2,4 centimes par réponse de conversation, chaque tranche de 10 $ achète environ 400 réponses de la taille évoquée plus haut.
En bref :
- Offre gratuite pour Opus 5.5 sur l’API : non
- Opus 5.5 sur le forfait gratuit de claude.ai : non, en date de début octobre 2026
- Prix mensuel fixe pour l’accès à la conversation : à partir de 20 $
- Remises les plus importantes sur l’API : le cache et Batch
- Modèles de texte gratuits à essayer à la place : les modèles ouverts du catalogue PicassoIA
Utiliser Claude sur PicassoIA
Opus 5.5 lui-même ne figure pas dans le catalogue PicassoIA au moment de la rédaction. Le modèle Opus le plus proche est Claude Opus 4.7, et la même collection référence Claude Fable 5, Claude Sonnet 5, Claude Sonnet 4.6 et Claude 4.5 Haiku. Vous ouvrez une page, vous tapez, et vous lisez la réponse. Il n’y a ni compte développeur à configurer, ni tableau de bord de facturation à surveiller.
Ouvrir la page du modèle
- Ouvrez la page de Claude Opus 4.7 dans la collection des grands modèles de langage.
- Saisissez votre question dans la zone Prompt. Collez du code, un brouillon ou un long document.
- Importez éventuellement une image, par exemple une capture d’écran de facture ou un schéma.
- Lancez le modèle et lisez la réponse.
Régler le prompt et les limites
| Réglage | Valeur par défaut | Ce qu’il fait |
|---|
| Prompt | Obligatoire | Votre question ou tâche |
| System Prompt | Vide | Définit le rôle, le ton et les règles de format |
| Max Tokens | 8 192 | Limite la longueur de la réponse |
| Image | Aucune | Ajoute une capture d’écran ou une photo |
| Max Image Resolution | 0,5 mégapixel | Réduit l’image avant l’envoi, ce qui économise du temps et de l’argent |
Trois bonnes habitudes améliorent les réponses. Donnez un rôle dans le system prompt, par exemple « Vous êtes un relecteur attentif de pages de tarifs. » Demandez un tableau lorsque vous voulez une comparaison. Baissez Max Tokens lorsque vous n’avez besoin que d’une réponse brève.
💡 Vous voulez un coût nul ? Le catalogue propose aussi des modèles ouverts comme GPT OSS 120B et Llama 4 Maverick Instruct, tous deux présentés comme gratuits à essayer. La qualité et les limites diffèrent d’Opus, alors testez-les sur vos propres prompts.

Associer Claude aux images et à la vidéo
Un modèle de langage a aussi sa place dans un flux de travail visuel. Demandez à Claude vingt prompts d’image détaillés d’environ 120 mots chacun. Cela représente environ 3 200 tokens de sortie, soit à peu près 6 centimes au tarif de sortie d’Opus 5.5, et les prompts contiennent les détails de l’objectif, de la lumière et de la texture qui donnent aux photos générées un rendu réaliste.
Une requête qui fonctionne bien ressemble à ceci : « Rédigez un prompt photographique de 70 mots pour une scène de cuisine au petit matin. Incluez le sujet, l’environnement, la direction de la lumière, l’objectif de l’appareil et deux textures de surface. Aucun texte dans l’image. » Claude renvoie un paragraphe dense que vous pouvez coller directement dans un modèle d’image, et une seconde passe ne coûte que quelques centimes de plus.
Passez ensuite aux modèles d’image et de vidéo de PicassoIA :
- Images : collez le prompt dans Seedream 4.5 ou P-Image pour des images fixes photoréalistes.
- Vidéo : utilisez une image fixe comme première image dans Seedance 2.5 Lite ou PicassoIA Video. La fiche de Seedance 2.5 Lite le présente comme un générateur gratuit et illimité de clips allant jusqu’à 10 secondes.
- Itérez : renvoyez le résultat à Claude, demandez ce qu’il faut modifier, puis relancez.
Utiliser un outil pour les mots et un autre pour les images permet de garder chaque coût visible. Vous payez quelques centimes pour le prompt, et vous laissez le modèle d’image ou de vidéo faire le gros du travail.

Créer vos premières images sur PicassoIA
Vous connaissez maintenant le prix d’Opus 5.5, le point où s’arrêtent les voies gratuites, et trois façons d’optimiser chaque token. Le plus rapide pour mettre tout cela en pratique, c’est de passer à la pratique. Ouvrez PicassoIA, demandez à un modèle Claude de rédiger un prompt photographique pour une scène qui vous tient à cœur, puis lancez-le dans Seedream 4.5. Prenez ensuite la meilleure image et confiez-la à un modèle vidéo pour la voir bouger. Parcourez le reste sur tous les modèles PicassoIA, et continuez d’expérimenter jusqu’à ce que les prompts vous ressemblent.