Tarifs de l’API ElevenLabs : coût, offre gratuite et limites de débit détaillées
Découvrez le coût réel de l’API ElevenLabs : tarifs au caractère pour chaque modèle vocal, crédits mensuels sur les six formules, ce qu’autorise l’offre gratuite, limites de concurrence par formule, tarifs de transcription et de musique, budgets chiffrés et moyens de réduire la facture.
Ouvrez la page des tarifs d’ElevenLabs et vous voyez six formules, une multitude de crédits et quelques montants en dollars pour mille caractères. Ouvrez votre première facture et les chiffres paraissent tout autres. L’écart vient de trois éléments que la page répartit sur plusieurs onglets : la manière dont un modèle convertit les caractères en crédits, la formule à laquelle votre compte est rattaché et le nombre de requêtes que vous pouvez lancer en même temps. Cet article réunit les trois dans un seul endroit, avec des exemples chiffrés, pour que vous puissiez estimer une facture avant d’écrire la moindre ligne de code d’intégration.
💡 Vérification des prix : tous les chiffres ci-dessous ont été vérifiés début octobre 2026. ElevenLabs modifie souvent ses tarifs et lance des promotions, considérez donc chaque chiffre comme un instantané et confirmez-le dans votre propre tableau de bord avant d’engager un budget.
Ce que facture réellement l’API
Crédits et dollars ne sont pas la même chose
ElevenLabs mesure la consommation dans deux unités. Les formules d’abonnement vous donnent une réserve mensuelle de crédits, et chaque caractère généré consomme une partie de ces crédits selon le modèle. La grille tarifaire de l’API à l’usage fonctionne plutôt en dollars pour 1 000 caractères. Les deux décrivent le même audio, mais elles ne se convertissent pas une à une, ce qui explique qu’un calcul mental rapide donne souvent un résultat très éloigné du montant réel.
Pour la synthèse vocale, la règle empirique est simple. Un modèle multilingue comme Multilingual v2 consomme environ 1 crédit par caractère. Les modèles Flash et Turbo consomment entre 0,5 et 1 crédit par caractère, ce qui en fait le choix économique pour les robots conversationnels et les agents téléphoniques.
Tarifs par modèle
Voici la grille tarifaire à l’usage pour la synthèse vocale, pour 1 000 caractères.
Modèle
Prix pour 1 000 caractères
Usage typique
Eleven v4
0,08 $ (promotion à 0,022 $ jusqu’au 12 octobre 2026)
La promotion sur la v4 prend fin quelques jours après cette vérification, donc calculez votre budget sur le prix catalogue, et non sur le prix promotionnel.
Choisir entre ces lignes revient surtout à se demander ce que l’auditeur remarque. Une vidéo avec voix off ou un livre audio est écouté une seule fois et jugé sur l’émotion, donc les modèles à 0,08 $ justifient leur prix. Un robot qui répond « votre commande a été expédiée » mille fois par jour est jugé sur la rapidité, et un modèle à 0,04 $ qui répond vite l’emporte sur une voix plus riche qui fait attendre l’appelant. Beaucoup d’équipes utilisent les deux : un modèle premium pour les contenus que les gens choisissent d’écouter, et un modèle Flash pour tout ce qui est automatisé.
Trois exemples de coût
En anglais, on compte en moyenne environ 6 caractères par mot en comptant les espaces et la ponctuation. Pour une estimation rapide, multipliez donc le nombre de mots par 6.
Chapitre de livre audio, 10 000 mots. Environ 60 000 caractères. À 0,08 $ pour 1 000, cela fait 4,80 $. Sur un modèle à 0,04 $, cela descend à 2,40 $.
Voix off d’une vidéo produit, 500 mots. Environ 3 000 caractères, soit 0,24 $ à 0,08 $ ou 0,12 $ à 0,04 $.
Robot d’assistance, 50 000 réponses de 300 caractères. Cela fait 15 millions de caractères : 600 $ à 0,04 $ pour 1 000, ou 1 200 $ à 0,08 $.
💡 Formule rapide :monthly cost = characters per month ÷ 1,000 × price per 1,000 characters. Exécutez-la deux fois, une fois pour votre volume le plus bas prévu et une fois pour votre volume le plus haut.
Formules, crédits et coût mensuel
L’abonnement est l’autre mode de paiement. Chaque formule vend une réserve mensuelle fixe de crédits, avec des options supplémentaires comme une licence commerciale, des sièges d’équipe et une concurrence plus élevée.
Comparaison des six formules
Formule
Prix mensuel
Crédits mensuels
Usage idéal
Free
0 $
10 000
Tests et prototypes
Starter
6 $
30 000
Créateurs solo, premier mois à tarif réduit
Creator
22 $
121 000
Production de contenus régulière, premier mois à tarif réduit
Pro
99 $
600 000
Petits produits et studios
Scale
299 $
1,8 million
Applications en croissance, trois sièges
Business
990 $
6 millions
Volume élevé, dix sièges
La facturation annuelle revient à deux mois offerts : vous payez dix mois et en utilisez douze. Les crédits non utilisés se reportent pendant deux mois au maximum, dans la limite de trois fois votre allocation mensuelle, tant que l’abonnement reste actif.
Coût par crédit selon la formule
Divisez le prix par le nombre de crédits et les formules cessent de se ressembler.
Formule
Prix effectif pour 1 000 crédits
Starter
0,20 $
Creator
0,18 $
Pro
0,165 $
Scale
0,166 $
Business
0,165 $
Deux points ressortent. Le coût par crédit baisse d’environ 17 pour cent de Starter à Pro, puis reste stable. Au-delà de Pro, vous payez pour la concurrence, les sièges et le support, et non pour un audio moins cher.
Le second point compte davantage. À 1 crédit par caractère, ces montants sont supérieurs aux tarifs à l’usage du premier tableau. Les deux grilles ne se facturent pas de la même façon : comparez donc votre volume prévu aux deux avant de choisir, et vérifiez dans votre tableau de bord le mode de facturation utilisé par votre compte.
Trois exemples de budgets mensuels
Voici comment trois projets réalistes se chiffrent selon les deux méthodes. La colonne à l’usage repose sur les tarifs catalogue du premier tableau.
Projet
Caractères par mois
Coût à l’usage
Formule adaptée
YouTubeur solo, 8 vidéos de 1 200 mots
57 600
4,61 $ à 0,08 $
Creator, 22 $ pour 121 000 crédits
Éditeur de cours, 40 leçons de 1 500 mots
360 000
28,80 $ à 0,08 $
Pro, 99 $ pour 600 000 crédits
Robot vocal, 500 000 réponses de 250 caractères
125 millions
5 000 $ à 0,04 $
Contrat sur mesure, car Business plafonne à 6 millions de crédits
Pouvoir acheter des tarifs à l’usage dépend de la configuration de facturation de votre compte. Lisez donc ce tableau comme une comparaison, et non comme un devis. La tendance reste la même : les petits et moyens projets entrent confortablement dans une formule, tandis qu’un robot à fort volume relève d’une discussion commerciale, et non d’un simple paiement en ligne.
L’offre gratuite en pratique
Ce que permettent 10 000 crédits
L’offre Free vous donne 10 000 crédits chaque mois pour 0 $. Sur un modèle qui consomme 1 crédit par caractère, cela représente 10 000 caractères : environ 1 700 mots, soit à peu près 11 minutes de parole finie à un rythme de lecture normal. Sur un modèle Flash à un demi-crédit par caractère, la même réserve va jusqu’à près de 20 minutes.
Cela suffit pour trois tâches :
Choisir une voix pour un projet
Vérifier que votre intégration envoie bien le texte et reçoit correctement l’audio
Construire un prototype à montrer à un client ou à un collègue
Limites à connaître
Pas de licence commerciale. Un audio que vous publiez ou vendez nécessite une formule payante.
Concurrence la plus basse. Deux requêtes simultanées sur les modèles multilingues et quatre sur Flash et Turbo.
Pas de place pour les traitements par lots. Un chapitre de 10 000 mots, soit 60 000 caractères, consommerait six mois de crédits gratuits.
Considérez l’une de ces trois limites comme votre signal de passage à une formule supérieure. Dès que vous devez publier l’audio à des fins commerciales, lancer plus de deux traitements en parallèle ou générer plus d’environ 10 000 caractères par mois, l’offre gratuite cesse d’être une formule et devient un essai. Starter à 6 $ est la plus petite marche supérieure : elle triple vos crédits mensuels et ajoute la licence commerciale.
💡 Astuce : réservez vos crédits gratuits à des scripts de test de deux ou trois phrases, jamais à des chapitres entiers. Réglez d’abord la voix, la vitesse et la stabilité, puis générez le texte complet une seule fois.
Limites de débit et concurrence
Les limites de cette API concernent surtout la concurrence : le nombre de requêtes en cours d’exécution au même moment, et non le nombre que vous envoyez par minute. Un modèle rapide qui termine en une seconde permet à un seul emplacement de traiter de nombreuses requêtes. Une génération longue et lente occupe son emplacement pendant toute sa durée.
Limites par formule
Formule
Multilingual v2 et v3
Flash et Turbo
Free
2
4
Starter
3
6
Creator
5
10
Pro
10
20
Scale
15
30
Business
15
30
Ce sont les limites publiées au moment de la rédaction. Les comptes Enterprise bénéficient de limites relevées, et les modèles récents peuvent avoir leurs propres plafonds, donc vérifiez dans le tableau de bord.
Si vous dépassez votre limite, l’API met la requête en file d’attente, ce qui ajoute un petit délai, ou renvoie une erreur HTTP 429. Prévoyez les deux cas :
Relancez avec un backoff exponentiel.
Ajoutez une gigue aléatoire pour que les nouvelles tentatives n’arrivent pas en vague.
Limitez les appels en cours de votre côté avec un sémaphore, réglé un peu en dessous de la limite de votre formule.
Un wrapper de nouvelle tentative minimal ressemble à ceci en Python :
import random
import time
def with_backoff(call, retries=5, base=0.5):
for attempt in range(retries):
try:
return call()
except RateLimitError:
time.sleep(base * 2 ** attempt + random.random() * 0.25)
raise RuntimeError("still rate limited after retries")
Remplacez RateLimitError par l’exception que lève votre client HTTP lors d’une erreur 429. L’attente passe d’une demi-seconde à huit secondes, et la fraction aléatoire empêche les workers parallèles de relancer en même temps.
Dimensionner votre concurrence
Utilisez cette estimation :
concurrent requests ≈ requests per second × seconds per generation
Une application qui atteint un pic de 8 requêtes par seconde avec 1,5 seconde par génération a besoin d’environ 12 emplacements simultanés. Sur les modèles Flash, cela tient dans la formule Pro, qui en autorise 20.
Un agent vocal est différent, car chaque appel en direct peut demander de la voix au même moment. Avec 25 appelants simultanés en pointe, il vous faut 25 emplacements, et sur les modèles Flash, seules les formules Scale ou Business (30) vous offrent cette marge. Les formules coûtent peu comparées à des appels coupés, donc dimensionnez pour votre heure la plus chargée, et non pour votre heure moyenne.
Tarifs de transcription et de musique
La voix ne représente qu’une partie de la facture. Si votre produit transforme aussi l’audio en texte ou crée des bandes sonores, ces compteurs tournent également.
Transcription Scribe
La transcription se facture à l’heure d’audio, et non au caractère :
Scribe v2 : 0,22 $ de l’heure pour les fichiers
Scribe v2 Realtime : 0,39 $ de l’heure, avec une latence d’environ 150 ms
Indices de vocabulaire : 0,05 $ de l’heure en supplément
Édition de la transcription : 0,07 $ de l’heure en supplément
Un lot de 100 heures d’entretiens enregistrés coûte environ 22 $. Un événement en direct de deux heures transcrit en temps réel coûte environ 0,78 $. À ces tarifs, la transcription est le poste le moins cher de la plupart des produits audio, donc elle décide rarement de la formule. Si vous voulez un second avis sur la précision, passez le même fichier dans GPT-4o Transcribe ou Gemini 3 Pro et comparez les transcriptions.
Outils de musique et de voix
La génération de musique se facture 0,15 $ par minute de sortie. Trente morceaux de trois minutes font 90 minutes, soit 13,50 $. Voice Isolator et Voice Changer coûtent chacun 0,12 $ par minute.
La facturation à la minute rend la musique facile à prévoir, mais aussi facile à dépenser sans le voir, car chaque nouvelle tentative d’un prompt est facturée à nouveau. Rédigez un brief précis, générez un court échantillon, et seulement ensuite demandez la durée complète. Vous pouvez tester ElevenLabs Music sur PicassoIA avant de l’intégrer à votre code.
Moyens de réduire votre facture
La plupart des économies viennent de l’envoi de moins de caractères et du choix de modèles moins chers pour les bons usages.
Adaptez le modèle à la tâche. Utilisez Flash pour les robots et les alertes, et réservez les modèles premium à la narration, là où l’émotion compte. Diviser par deux le tarif du trafic des robots est généralement la plus grosse économie unique.
Mettez en cache chaque phrase répétée. Les salutations, les messages de menu et les messages d’erreur ne changent jamais. Calculez un hash du texte, de la voix et des réglages ensemble, stockez le fichier audio et servez-le depuis le stockage. Si 40 pour cent de vos réponses se répètent, vous cessez de payer ces 40 pour cent.
Envoyez un texte propre. Supprimez le HTML, le balisage, les notes de bas de page et les espaces répétés avant la requête. Chaque caractère est facturé.
Découpez les longs scripts en gardant le contexte. Coupez aux sauts de paragraphe et transmettez les phrases voisines comme contexte, afin que le ton reste cohérent et qu’une modification d’une ligne ne vous oblige pas à régénérer tout le script.
Testez avant de lancer le lot. Générez un paragraphe, écoutez-le, puis générez le reste.
Fixez un plafond dans votre propre code. Suivez le nombre de caractères par jour, déclenchez une alerte à 80 pour cent du budget et arrêtez à 100 pour cent.
Surveillez vos nouvelles tentatives. Une boucle de relance qui renvoie une requête pourtant réussie vous facture deux fois. Étiquetez chaque traitement avec un ID pour repérer les doublons.
Simulez l’API dans vos tests. Une suite de tests qui appelle le vrai point d’accès à chaque commit consomme discrètement des crédits. Enregistrez une réponse d’exemple et rejouez-la en intégration continue.
Séparez le développement de la production. Les environnements de préproduction, les démonstrations et les expériences puisent dans la même réserve que votre produit en service. Donnez-leur un quota réduit ou un compte dédié, pour qu’une boucle dans un script de test ne consomme pas le quota du mois.
Auditez chaque mois les plus gros scripts. Triez les générations du mois précédent par nombre de caractères. Quelques longs traitements représentent généralement l’essentiel de la facture, et ce sont eux qu’il vaut la peine de mettre en cache ou de raccourcir.
Testez les voix sur PicassoIA d’abord
Avant d’intégrer une API payante en production, testez les voix là où un mauvais choix ne coûte rien. PicassoIA héberge plusieurs modèles ElevenLabs dans sa collection de synthèse vocale, ainsi que des modèles d’autres laboratoires, ce qui permet de comparer les rendus côte à côte. Il propose aussi ElevenLabs Dubbing pour traduire des vidéos dans d’autres langues.
Ouvrez la page Eleven v3 dans la collection de synthèse vocale.
Collez deux ou trois phrases de votre script dans le champ Prompt.
Choisissez une voix. Il y en a 26 au choix, et la voix par défaut est Rachel.
Réglez le code de langue, par exemple en, es ou fr.
Laissez la stabilité à 0,5 et le boost de similarité à 0,75 pour le premier essai.
Lancez la génération, écoutez, ajustez un réglage à la fois, puis téléchargez l’audio.
Réglages qui méritent d’être modifiés
Réglage
Plage
Valeur par défaut
Conseil
Vitesse
0,25 à 4
1
Restez entre 0,9 et 1,15 pour une narration naturelle
Style
0 à 1
0
Essayez 0,2 à 0,4 pour la narration. Les valeurs élevées sonnent théâtrales
Stabilité
0 à 1
0,5
Augmentez-la pour les longs livres audio, baissez-la pour une diction plus variée
Boost de similarité
0 à 1
0,75
Augmentez-le pour une correspondance plus fidèle à la voix choisie
Texte précédent et suivant
Texte
Vide
Collez les phrases environnantes pour lisser l’intonation entre les segments
💡 Astuce : modifiez un seul réglage par essai et notez vos observations. Dix courts extraits de test vous en apprennent plus sur le coût et la qualité qu’une seule génération longue.
Essayez sur Picasso IA
Votre prochaine voix off, bande sonore ou transcription n’a pas besoin d’un tableur budgétaire dès le premier jour. Ouvrez la collection de synthèse vocale sur Picasso IA, collez un script court dans V3 et écoutez le résultat en quelques secondes. Passez ensuite le même script dans deux autres voix et gardez celle qui convient à votre public.
Vous préparez un podcast, un cours ou une démo de produit ? Les modèles d’images photoréalistes de la plateforme peuvent créer les miniatures, bannières et illustrations de scène qui accompagnent votre audio. Rédigez un prompt, choisissez un modèle et voyez le résultat. Parcourez tous les modèles de voix, de musique, de transcription et d’image sur picassoia.com/en/all-models, et commencez dès aujourd’hui à expérimenter avec vos propres projets.