Preços da API da ElevenLabs: custo, plano gratuito e limites de requisições explicados
Veja quanto custa a API da ElevenLabs na prática: preços por caractere de cada modelo de voz, créditos mensais nos seis planos, o que o plano gratuito permite, limites de concorrência por plano, tarifas de transcrição e música, orçamentos de exemplo e formas de reduzir a conta.
Abra a página de preços da ElevenLabs e você verá seis planos, um monte de créditos e alguns valores em dólar por mil caracteres. Ao abrir a primeira fatura, os números parecem diferentes. A diferença vem de três coisas que a página espalha em várias abas: como um modelo converte caracteres em créditos, em qual plano sua conta está e quantas requisições você pode executar ao mesmo tempo. Este artigo reúne as três em um só lugar, com exemplos práticos, para que você possa estimar uma fatura antes de escrever qualquer linha de código de integração.
💡 Conferência de preços: todos os valores abaixo foram verificados no início de outubro de 2026. A ElevenLabs muda tarifas e faz promoções com frequência, então trate cada número como uma fotografia do momento e confirme no seu painel antes de comprometer o orçamento.
O que a API realmente cobra
Créditos e dólares são coisas diferentes
A ElevenLabs mede o uso em duas unidades. Os planos por assinatura oferecem um pacote mensal de créditos, e cada caractere gerado consome parte deles, dependendo do modelo. A lista de preços da API com cobrança por uso trabalha em dólares por 1.000 caracteres. As duas formas descrevem o mesmo áudio, mas não se convertem uma na outra de forma direta, e por isso um cálculo mental rápido costuma ficar longe do número real.
Na conversão de texto para fala, a regra prática é simples. Um modelo multilíngue como o Multilingual v2 consome cerca de 1 crédito por caractere. Os modelos Flash e Turbo consomem entre 0,5 e 1 crédito por caractere, e é por isso que eles são a escolha econômica para chatbots e agentes telefônicos.
Tarifas por modelo
Aqui está a lista de preços por uso para conversão de texto em fala, por 1.000 caracteres.
Modelo
Preço por 1.000 caracteres
Uso típico
Eleven v4
US$ 0,08 (promocional US$ 0,022 até 12 de outubro de 2026)
O desconto do v4 termina alguns dias depois desta conferência, então planeje seu orçamento pelo preço de lista, e não pelo promocional.
Escolher entre essas linhas depende, sobretudo, do que o ouvinte percebe. Um vídeo narrado ou um audiolivro é ouvido uma vez e avaliado pela emoção, então os modelos de US$ 0,08 justificam o preço. Um bot que responde "seu pedido foi enviado" mil vezes por dia é avaliado pela velocidade, e um modelo de US$ 0,04 que responde rápido vence uma voz mais rica que faz o cliente esperar. Muitas equipes usam os dois: um modelo premium para conteúdos que as pessoas escolhem ouvir, e um modelo Flash para tudo o que é automatizado.
Três exemplos de custo
O inglês tem cerca de 6 caracteres por palavra, contando espaços e pontuação, então multiplique o número de palavras por 6 para uma estimativa rápida.
Capítulo de audiolivro, 10.000 palavras. Cerca de 60.000 caracteres. A US$ 0,08 por 1.000, são US$ 4,80. Em um modelo de US$ 0,04, cai para US$ 2,40.
Narração de vídeo de produto, 500 palavras. Cerca de 3.000 caracteres, então US$ 0,24 a US$ 0,08 ou US$ 0,12 a US$ 0,04.
Bot de atendimento, 50.000 respostas de 300 caracteres. São 15 milhões de caracteres: US$ 600 a US$ 0,04 por 1.000, ou US$ 1.200 a US$ 0,08.
💡 Fórmula rápida:monthly cost = characters per month ÷ 1,000 × price per 1,000 characters. Execute duas vezes, uma para o seu menor volume esperado e outra para o maior.
Planos, créditos e custo mensal
As assinaturas são a outra forma de pagar. Cada plano vende um pacote mensal fixo de créditos, além de extras como licença comercial, vagas para equipe e concorrência maior.
Seis planos comparados
Plano
Preço mensal
Créditos mensais
Melhor para
Free
US$ 0
10.000
Testes e protótipos
Starter
US$ 6
30.000
Criadores individuais, primeiro mês com desconto
Creator
US$ 22
121.000
Produção regular de conteúdo, primeiro mês com desconto
Pro
US$ 99
600.000
Pequenos produtos e estúdios
Scale
US$ 299
1,8 milhão
Aplicativos em crescimento, três vagas
Business
US$ 990
6 milhões
Volume alto, dez vagas
A cobrança anual equivale a dois meses grátis: você paga dez e usa doze. Os créditos não utilizados são transferidos por até dois meses, limitados a três vezes a sua cota mensal, desde que a assinatura continue ativa.
Custo por crédito em cada plano
Divida o preço pelos créditos e os planos deixam de parecer iguais.
Plano
Preço efetivo por 1.000 créditos
Starter
US$ 0,20
Creator
US$ 0,18
Pro
US$ 0,165
Scale
US$ 0,166
Business
US$ 0,165
Duas coisas se destacam. O custo por crédito cai cerca de 17 por cento do Starter ao Pro, e depois fica estável. Acima do Pro, você paga por concorrência, vagas e suporte, e não por áudio mais barato.
O segundo ponto é o mais importante. Com 1 crédito por caractere, esses valores ficam acima das tarifas por uso da primeira tabela. As duas listas de preço são cobradas de formas diferentes, então compare seu volume previsto com as duas antes de escolher, e confira no seu painel qual modo de cobrança a sua conta usa.
Três orçamentos mensais de exemplo
Veja como três projetos realistas ficam quando você os calcula das duas formas. A coluna de uso por consumo usa as tarifas de lista da primeira tabela.
Projeto
Caracteres por mês
Custo por uso
Plano adequado
YouTuber solo, 8 vídeos de 1.200 palavras
57.600
US$ 4,61 a US$ 0,08
Creator, US$ 22 por 121.000 créditos
Editora de cursos, 40 aulas de 1.500 palavras
360.000
US$ 28,80 a US$ 0,08
Pro, US$ 99 por 600.000 créditos
Bot de voz, 500.000 respostas de 250 caracteres
125 milhões
US$ 5.000 a US$ 0,04
Contrato personalizado, já que o Business chega no máximo a 6 milhões de créditos
Saber se você pode comprar tarifas por uso na sua conta depende da configuração de cobrança, então leia esta tabela como uma comparação, e não como uma cotação. O padrão continua valendo: projetos pequenos e médios cabem confortavelmente em um plano, enquanto um bot de alto volume é uma conversa com vendas, e não uma compra direta.
O plano gratuito na prática
O que 10.000 créditos compram
O plano gratuito oferece 10.000 créditos por mês por US$ 0. Em um modelo que gasta 1 crédito por caractere, isso dá 10.000 caracteres: cerca de 1.700 palavras, ou algo em torno de 11 minutos de fala finalizada em um ritmo de leitura normal. Em um modelo Flash, que gasta meio crédito por caractere, o mesmo saldo se estende por quase 20 minutos.
Isso é suficiente para três tarefas:
Escolher uma voz para um projeto
Testar se sua integração envia texto e recebe áudio corretamente
Criar um protótipo para mostrar a um cliente ou a um colega de equipe
Limites a esperar
Sem licença comercial. Áudio que você publica ou vende precisa de um plano pago.
Concorrência mínima. Duas requisições simultâneas nos modelos multilíngues e quatro nos Flash e Turbo.
Sem espaço para lotes. Um capítulo de 10.000 palavras, com 60.000 caracteres, consumiria seis meses de créditos gratuitos.
Considere qualquer um desses três pontos como sinal para fazer upgrade. No momento em que você precisar publicar o áudio comercialmente, rodar mais de dois trabalhos ao mesmo tempo ou gerar mais de cerca de 10.000 caracteres por mês, o plano gratuito deixa de ser um plano e vira um teste. O Starter, de US$ 6, é o menor passo acima, e triplica seus créditos mensais enquanto adiciona a licença comercial.
💡 Dica: use os créditos gratuitos em roteiros de teste de duas ou três frases, nunca em capítulos completos. Defina voz, velocidade e estabilidade primeiro e, depois, gere o texto inteiro uma vez.
Limites de taxa e concorrência
Os limites desta API se referem sobretudo à concorrência: quantas requisições estão rodando ao mesmo tempo, e não quantas você envia por minuto. Um modelo rápido que termina em um segundo permite que uma mesma vaga atenda muitas requisições. Uma geração lenta e longa ocupa a vaga durante toda a execução.
Limites por plano
Plano
Multilingual v2 e v3
Flash e Turbo
Free
2
4
Starter
3
6
Creator
5
10
Pro
10
20
Scale
15
30
Business
15
30
Estes são os limites publicados no momento da redação. Contas Enterprise têm limites elevados, e modelos mais novos podem ter tetos próprios, então confira no painel.
Ao ultrapassar o limite, a API ou coloca a requisição em fila, o que gera um pequeno atraso, ou devolve um erro HTTP 429. Planeje para os dois casos:
Tente novamente com backoff exponencial.
Adicione jitter aleatório para que as novas tentativas não cheguem em onda.
Limite as chamadas em andamento do seu lado com um semáforo, configurado um pouco abaixo do limite do seu plano.
Um wrapper mínimo de nova tentativa fica assim em Python:
import random
import time
def with_backoff(call, retries=5, base=0.5):
for attempt in range(retries):
try:
return call()
except RateLimitError:
time.sleep(base * 2 ** attempt + random.random() * 0.25)
raise RuntimeError("still rate limited after retries")
Troque RateLimitError pela exceção que o seu cliente HTTP lança em um 429. A espera cresce de meio segundo até oito segundos, e a fração aleatória impede que os workers paralelos tentem de novo ao mesmo tempo.
Dimensionando sua concorrência
Use esta estimativa:
concurrent requests ≈ requests per second × seconds per generation
Um app que chega a 8 requisições por segundo, com 1,5 segundo por geração, precisa de cerca de 12 vagas simultâneas. Nos modelos Flash, isso cabe dentro do Pro, que permite 20.
Um agente de voz é diferente, porque cada chamada ativa pode pedir fala ao mesmo tempo. Com 25 interlocutores simultâneos no pico, você precisa de 25 vagas, e nos modelos Flash só o Scale ou o Business (30) oferecem essa folga. Os planos são baratos se comparados a chamadas perdidas, então dimensione para a sua hora mais movimentada, e não para a média.
Tarifas de transcrição e música
A voz é só parte da conta. Se o seu produto também transforma áudio em texto ou cria trilhas sonoras, esses medidores também rodam.
Transcrição com Scribe Speech to Text
A transcrição é cobrada por hora de áudio, e não por caractere:
Scribe v2: US$ 0,22 por hora para arquivos
Scribe v2 Realtime: US$ 0,39 por hora, com latência de cerca de 150 ms
Dicas de vocabulário: US$ 0,05 por hora a mais
Edição de transcrição: US$ 0,07 por hora a mais
Um acervo de 100 horas de entrevistas gravadas custa cerca de US$ 22. Um evento ao vivo de duas horas transcrito em tempo real custa cerca de US$ 0,78. Com essas tarifas, a transcrição é o item mais barato na maioria dos produtos de áudio, então raramente decide o plano. Se você quer uma segunda opinião sobre a precisão, rode o mesmo arquivo pelo GPT-4o Transcribe ou pelo Gemini 3 Pro e compare as transcrições.
Ferramentas de música e voz
A geração de música é cobrada a US$ 0,15 por minuto de saída. Trinta faixas de três minutos somam 90 minutos, ou US$ 13,50. O Voice Isolator e o Voice Changer custam US$ 0,12 por minuto cada um.
A cobrança por minuto torna a música fácil de prever e fácil de estourar, porque cada nova tentativa de um prompt é cobrada de novo. Escreva um briefing objetivo, gere uma amostra curta e só então peça a duração completa. Você pode testar o ElevenLabs Music no PicassoIA antes de integrá-lo ao código.
Formas de reduzir a conta
A maior parte da economia vem de enviar menos caracteres e escolher modelos mais baratos para os trabalhos certos.
Combine o modelo com a tarefa. Use o Flash para bots e alertas, e reserve os modelos premium para narrações em que a emoção importa. Cortar pela metade a tarifa do tráfego de bots costuma ser a maior economia isolada.
Guarde em cache cada frase repetida. Saudações, menus de voz e mensagens de erro nunca mudam. Gere um hash do texto, da voz e das configurações juntos, armazene o arquivo de áudio e sirva-o a partir do armazenamento. Se 40 por cento das suas respostas se repetem, você deixa de pagar por 40 por cento delas.
Envie texto limpo. Remova HTML, marcação, notas de rodapé e espaços em branco repetidos antes da requisição. Cada caractere é cobrado.
Divida roteiros longos com contexto. Separe nas quebras de parágrafo e passe as frases vizinhas como contexto, para que o tom continue consistente e uma edição de uma linha não obrigue a regerar o roteiro inteiro.
Teste antes de gerar em lote. Rode um parágrafo, ouça e só então rode o resto.
Defina um teto no seu próprio código. Acompanhe os caracteres por dia, emita um alerta ao atingir 80 por cento do orçamento e pare em 100.
Fique de olho nas novas tentativas. Um laço de retry que reenvia uma requisição que na verdade deu certo cobra você duas vezes. Marque cada trabalho com um ID para identificar duplicatas.
Simule a API nos testes. Uma suíte de testes que chama o endpoint real a cada commit consome créditos sem você perceber. Grave uma resposta de exemplo e reproduza-a na integração contínua.
Separe desenvolvimento de produção. Ambientes de staging, demos e experimentos usam o mesmo pacote que o seu produto ao vivo. Dê a eles uma cota pequena ou uma conta dedicada, para que um laço em um script de teste não consuma a franquia do mês.
Audite mensalmente os maiores roteiros. Ordene as gerações do mês passado pelo número de caracteres. Poucos trabalhos longos costumam responder pela maior parte da conta, e são esses que valem a pena guardar em cache ou encurtar.
Teste as vozes no PicassoIA primeiro
Antes de colocar uma API paga em produção, teste vozes onde uma escolha errada não custa nada. O PicassoIA hospeda vários modelos da ElevenLabs em sua coleção de texto para fala, além de modelos de outros laboratórios, para que você compare a entrega lado a lado. Ele também oferece o ElevenLabs Dubbing para traduzir vídeos para outros idiomas.
Cole duas ou três frases do seu roteiro no campo Prompt.
Escolha uma voz. Há 26 opções, e a voz padrão é a Rachel.
Defina o código de idioma, como en, es ou fr.
Deixe a estabilidade em 0,5 e o reforço de similaridade em 0,75 na primeira execução.
Gere, ouça, ajuste uma configuração por vez e, então, baixe o áudio.
Configurações que valem a pena mudar
Configuração
Intervalo
Padrão
Dica
Velocidade
0,25 a 4
1
Fique entre 0,9 e 1,15 para uma narração natural
Estilo
0 a 1
0
Teste de 0,2 a 0,4 para contar histórias. Valores altos soam teatrais
Estabilidade
0 a 1
0,5
Aumente para audiolivros longos, diminua para uma entrega mais variada
Reforço de similaridade
0 a 1
0,75
Aumente para uma correspondência mais fiel à voz escolhida
Texto anterior e seguinte
Texto
Vazio
Cole as frases vizinhas para suavizar a entonação entre os blocos
💡 Dica: mude uma configuração por execução e anote tudo. Dez clipes curtos de teste ensinam mais sobre custo e qualidade do que uma geração longa.
Experimente no Picasso IA
Sua próxima narração, trilha sonora ou transcrição não precisa de uma planilha de orçamento no primeiro dia. Abra a coleção de texto para fala no Picasso IA, cole um roteiro curto no V3 e ouça o resultado em segundos. Depois, rode o mesmo roteiro com outras duas vozes e fique com a que combina com o seu público.
Está montando um podcast, um curso ou a demo de um produto? Os modelos de imagem fotorrealistas da plataforma podem criar as miniaturas, os banners e a arte de cena que acompanham o seu áudio. Escreva um prompt, escolha um modelo e veja o que aparece. Explore todos os modelos de voz, música, transcrição e imagem em picassoia.com/en/all-models e comece a experimentar com os seus projetos hoje.