Precios de la API de ElevenLabs: costo, plan gratuito y límites de frecuencia explicados
Descubre cuánto cuesta realmente la API de ElevenLabs: tarifas por carácter de cada modelo de voz, créditos mensuales en los seis planes, qué permite el plan gratuito, límites de concurrencia por plan, tarifas de transcripción y música, presupuestos de ejemplo y formas de reducir la factura.
Abres la página de precios de ElevenLabs y ves seis planes, un montón de créditos y unas cifras en dólares por cada mil caracteres. Luego abres tu primera factura y los números parecen distintos. La diferencia viene de tres cosas que la página reparte en varias pestañas: cómo convierte un modelo los caracteres en créditos, a qué plan pertenece tu cuenta y cuántas solicitudes puedes ejecutar al mismo tiempo. Este artículo reúne las tres en un solo lugar, con ejemplos resueltos, para que puedas estimar una factura antes de escribir una línea de código de integración.
💡 Comprobación de precios: todas las cifras de abajo se revisaron a principios de octubre de 2026. ElevenLabs cambia tarifas y lanza promociones con frecuencia, así que toma cada número como una instantánea y confírmalo en tu panel antes de destinar presupuesto.
Lo que la API cobra realmente
Créditos y dólares no son lo mismo
ElevenLabs mide el uso en dos monedas. Los planes de suscripción te dan un fondo mensual de créditos, y cada carácter generado gasta una parte de ellos según el modelo. La lista de precios de la API por uso se expresa en dólares por cada 1000 caracteres. Ambas describen el mismo audio, pero no se convierten una a una, por eso un cálculo mental rápido suele quedarse lejos de la cifra real.
En texto a voz la regla práctica es sencilla. Un modelo multilingüe como Multilingual v2 gasta alrededor de 1 crédito por carácter. Los modelos Flash y Turbo gastan entre 0,5 y 1 crédito por carácter, por eso son la opción económica para chatbots y agentes telefónicos.
Tarifas por modelo
Esta es la lista de precios por uso para texto a voz, por cada 1000 caracteres.
Modelo
Precio por 1000 caracteres
Uso habitual
Eleven v4
$0.08 (promocional $0.022 hasta el 12 de octubre de 2026)
El descuento de la v4 termina pocos días después de esta comprobación, así que presupuesta con el precio de lista, no con el promocional.
Elegir entre estas filas depende sobre todo de lo que note quien escucha. Un video narrado o un audiolibro se reproduce una vez y se juzga por la emoción, así que los modelos de $0.08 justifican su precio. Un bot que responde "tu pedido ya fue enviado" mil veces al día se juzga por la velocidad, y un modelo de $0.04 que responde rápido gana a una voz más rica que obliga a esperar a quien llama. Muchos equipos usan ambos: un modelo premium para el contenido que la gente elige escuchar, y un modelo Flash para todo lo automatizado.
Tres ejemplos de costo
El inglés promedia unos 6 caracteres por palabra si cuentas los espacios y la puntuación, así que multiplica las palabras por 6 para una estimación rápida.
Capítulo de audiolibro, 10 000 palabras. Unos 60 000 caracteres. A $0.08 por 1000 son $4.80. En un modelo de $0.04 baja a $2.40.
Locución de un video de producto, 500 palabras. Unos 3000 caracteres, así que $0.24 a $0.08 o $0.12 a $0.04.
Bot de atención al cliente, 50 000 respuestas de 300 caracteres. Son 15 millones de caracteres: $600 a $0.04 por 1000, o $1200 a $0.08.
💡 Fórmula rápida:monthly cost = characters per month ÷ 1,000 × price per 1,000 characters. Hazlo dos veces, una con tu volumen mínimo esperado y otra con el máximo.
Planes, créditos y costo mensual
Las suscripciones son la otra forma de pagar. Cada plan vende un fondo mensual fijo de créditos, además de extras como una licencia comercial, puestos para el equipo y mayor concurrencia.
Los seis planes comparados
Plan
Precio mensual
Créditos mensuales
Mejor opción para
Free
$0
10 000
Pruebas y prototipos
Starter
$6
30 000
Creadores independientes, primer mes con descuento
Creator
$22
121 000
Producción de contenido regular, primer mes con descuento
Pro
$99
600 000
Productos pequeños y estudios
Scale
$299
1,8 millones
Apps en crecimiento, tres puestos
Business
$990
6 millones
Volumen alto, diez puestos
La facturación anual equivale a dos meses gratis: pagas diez y usas doce. Los créditos no usados se acumulan durante hasta dos meses, con un tope de tres veces tu asignación mensual, siempre que la suscripción siga activa.
Costo por crédito según el plan
Divide el precio entre los créditos y los planes dejan de parecerse.
Plan
Precio efectivo por 1000 créditos
Starter
$0.20
Creator
$0.18
Pro
$0.165
Scale
$0.166
Business
$0.165
Hay dos cosas que llaman la atención. El costo por crédito baja cerca de un 17 por ciento de Starter a Pro, y luego se estabiliza. A partir de Pro pagas por concurrencia, puestos y soporte, no por audio más barato.
El segundo punto importa más. Con 1 crédito por carácter, estas cifras quedan por encima de las tarifas por uso de la primera tabla. Las dos listas de precios se facturan de forma distinta, así que compara tu volumen previsto con ambas antes de elegir, y revisa en tu panel qué modo de facturación usa tu cuenta.
Tres presupuestos mensuales de ejemplo
Así quedan tres proyectos realistas si los calculas de las dos formas. La columna de uso por API usa las tarifas de lista de la primera tabla.
Proyecto
Caracteres al mes
Costo por uso
Plan adecuado
YouTuber independiente, 8 videos de 1200 palabras
57 600
$4.61 a $0.08
Creator, $22 por 121 000 créditos
Editorial de cursos, 40 lecciones de 1500 palabras
360 000
$28.80 a $0.08
Pro, $99 por 600 000 créditos
Bot de voz, 500 000 respuestas de 250 caracteres
125 millones
$5000 a $0.04
Contrato a medida, ya que Business llega como máximo a 6 millones de créditos
Si puedes comprar tarifas por uso en tu cuenta depende de tu configuración de facturación, así que lee esta tabla como una comparación, no como un presupuesto. El patrón se mantiene: los proyectos pequeños y medianos encajan cómodamente en un plan, mientras que un bot de alto volumen es una conversación comercial, no una compra en línea.
El plan gratuito en la práctica
Lo que dan 10 000 créditos
El plan Free te da 10 000 créditos cada mes por $0. Con un modelo que gasta 1 crédito por carácter, eso son 10 000 caracteres: unas 1700 palabras, o alrededor de 11 minutos de voz terminada a un ritmo normal de lectura. Con un modelo Flash, que gasta medio crédito por carácter, el mismo fondo da para unos 20 minutos.
Eso alcanza para tres tareas:
Elegir una voz para un proyecto
Comprobar que tu integración envía texto y recibe audio correctamente
Crear un prototipo para enseñárselo a un cliente o a un compañero de equipo
Límites que debes esperar
Sin licencia comercial. El audio que publiques o vendas necesita un plan de pago.
Concurrencia mínima. Dos solicitudes simultáneas en modelos multilingües y cuatro en Flash y Turbo.
Sin espacio para trabajos por lotes. Un capítulo de 10 000 palabras de 60 000 caracteres consumiría seis meses de créditos gratuitos.
Toma cualquiera de estos tres como señal para mejorar el plan. En el momento en que necesites publicar el audio con fines comerciales, ejecutar más de dos trabajos a la vez o generar más de unos 10 000 caracteres al mes, el plan gratuito deja de ser un plan y pasa a ser una prueba. Starter, a $6, es el primer escalón y triplica tus créditos mensuales mientras añade la licencia comercial.
💡 Consejo: gasta los créditos gratuitos en guiones de prueba de dos o tres frases, nunca en capítulos completos. Ajusta primero la voz, la velocidad y la estabilidad, y luego genera el texto completo una sola vez.
Límites de frecuencia y concurrencia
Los límites de esta API tienen que ver sobre todo con la concurrencia: cuántas solicitudes se ejecutan al mismo tiempo, no cuántas envías por minuto. Un modelo rápido que termina en un segundo permite que un mismo espacio atienda muchas solicitudes. Una generación lenta y larga ocupa su espacio durante toda la ejecución.
Límites por plan
Plan
Multilingual v2 y v3
Flash y Turbo
Free
2
4
Starter
3
6
Creator
5
10
Pro
10
20
Scale
15
30
Business
15
30
Estos son los límites publicados en el momento de escribir esto. Las cuentas empresariales tienen límites elevados, y los modelos más nuevos pueden tener techos propios, así que revísalo en el panel.
Si superas tu límite, la API pone la solicitud en cola, lo que añade un pequeño retraso, o devuelve un error HTTP 429. Prepárate para ambas cosas:
Reintenta con espera exponencial.
Añade una variación aleatoria (jitter) para que los reintentos no lleguen en oleada.
Limita tú mismo las llamadas en curso con un semáforo (semaphore), fijado un poco por debajo del límite de tu plan.
Así se ve un envoltorio mínimo de reintentos en Python:
import random
import time
def with_backoff(call, retries=5, base=0.5):
for attempt in range(retries):
try:
return call()
except RateLimitError:
time.sleep(base * 2 ** attempt + random.random() * 0.25)
raise RuntimeError("still rate limited after retries")
Sustituye RateLimitError por la excepción que lance tu cliente HTTP ante un 429. La espera crece de medio segundo a ocho segundos, y la fracción aleatoria evita que los trabajadores paralelos reintenten al mismo ritmo.
Cómo dimensionar tu concurrencia
Usa esta estimación:
concurrent requests ≈ requests per second × seconds per generation
Una app que alcanza 8 solicitudes por segundo con 1,5 segundos por generación necesita unos 12 espacios simultáneos. En modelos Flash eso cabe dentro de Pro, que permite 20.
Un agente de voz es distinto, porque cada llamada en vivo puede pedir voz al mismo tiempo. Con 25 personas que llaman a la vez en hora punta necesitas 25 espacios, y en modelos Flash solo Scale o Business (30) te dan ese margen. Los planes son baratos comparados con las llamadas perdidas, así que dimensiona para tu hora más cargada, no para la media.
Tarifas de transcripción y música
La voz es solo una parte de la factura. Si tu producto también convierte audio en texto o genera bandas sonoras, esos contadores también corren.
Scribe, voz a texto
La transcripción se cobra por hora de audio, no por carácter:
Scribe v2: $0.22 por hora para archivos
Scribe v2 Realtime: $0.39 por hora, con una latencia de unos 150 ms
Pistas de vocabulario: $0.05 por hora adicional
Edición de transcripciones: $0.07 por hora adicional
Un lote de 100 horas de entrevistas grabadas cuesta unos $22. Un evento en vivo de dos horas transcrito en tiempo real cuesta unos $0.78. Con esas tarifas, la transcripción es la partida más barata en la mayoría de los productos de audio, así que rara vez decide el plan. Si quieres una segunda opinión sobre la precisión, pasa el mismo archivo por GPT-4o Transcribe o Gemini 3 Pro y compara las transcripciones.
Herramientas de música y voz
La generación de música se cobra a $0.15 por minuto de salida. Treinta pistas de tres minutos son 90 minutos, o $13.50. Voice Isolator y Voice Changer cuestan $0.12 por minuto cada uno.
La facturación por minuto hace que la música sea fácil de prever y fácil de gastar de más, porque cada reintento de un prompt se vuelve a cobrar. Escribe un encargo preciso, genera una muestra corta y solo después pide la duración completa. Puedes probar ElevenLabs Music en PicassoIA antes de conectarlo a tu código.
Formas de reducir la factura
La mayoría de los ahorros vienen de enviar menos caracteres y de elegir modelos más baratos para cada tarea.
Elige el modelo según la tarea. Usa Flash para bots y alertas, y reserva los modelos premium para las narraciones en las que la emoción importa. Reducir a la mitad la tarifa del tráfico de bots suele ser el ahorro individual más grande.
Guarda en caché cada frase repetida. Los saludos, los menús de voz y los mensajes de error nunca cambian. Calcula un hash del texto, la voz y la configuración juntos, guarda el archivo de audio y sírvelo desde almacenamiento. Si el 40 por ciento de tus respuestas se repite, dejas de pagar por ese 40 por ciento.
Envía texto limpio. Quita el HTML, el marcado, las notas al pie y los espacios en blanco repetidos antes de la solicitud. Cada carácter se cobra.
Divide los guiones largos con contexto. Separa por saltos de párrafo y pasa las frases vecinas como contexto, para que el tono se mantenga coherente y una corrección de una línea no obligue a regenerar todo el guion.
Haz una vista previa antes de procesar por lotes. Genera un párrafo, escúchalo y luego genera el resto.
Pon un tope en tu propio código. Registra los caracteres por día, avisa al llegar al 80 por ciento del presupuesto y detente al 100.
Vigila los reintentos. Un bucle de reintentos que vuelve a enviar una solicitud que sí se completó te cobra dos veces. Etiqueta cada trabajo con un ID para detectar duplicados.
Simula la API en las pruebas. Un conjunto de pruebas que llama al endpoint real en cada commit gasta créditos en silencio. Graba una respuesta de muestra y reprodúcela en la integración continua.
Separa el desarrollo de la producción. Los entornos de staging, las demos y los experimentos usan el mismo fondo que tu producto en vivo. Dales una cuota pequeña o una cuenta dedicada, para que un bucle en un script de prueba no consuma la asignación del mes.
Audita mensualmente los guiones más grandes. Ordena las generaciones del mes pasado por número de caracteres. Unos pocos trabajos largos suelen explicar la mayor parte de la factura, y esos son los que vale la pena guardar en caché o acortar.
Prueba las voces en PicassoIA primero
Antes de conectar una API de pago a producción, prueba voces donde una elección equivocada no cuesta nada. PicassoIA aloja varios modelos de ElevenLabs en su colección de texto a voz, además de modelos de otros laboratorios, para que puedas comparar la entrega lado a lado. También ofrece ElevenLabs Dubbing para traducir videos a otros idiomas.
Pega dos o tres frases de tu guion en el campo Prompt.
Elige una voz. Hay 26 entre las que escoger, y la predeterminada es Rachel.
Fija el código de idioma, como en, es o fr.
Deja la estabilidad en 0,5 y el refuerzo de similitud en 0,75 para la primera ejecución.
Genera, escucha, ajusta un solo parámetro cada vez y luego descarga el audio.
Ajustes que vale la pena cambiar
Ajuste
Rango
Predeterminado
Consejo
Velocidad
0,25 a 4
1
Mantente entre 0,9 y 1,15 para una narración natural
Estilo
0 a 1
0
Prueba 0,2 a 0,4 para narrar historias. Los valores altos suenan teatrales
Estabilidad
0 a 1
0,5
Súbela para audiolibros largos, bájala para una entrega más variada
Refuerzo de similitud
0 a 1
0,75
Súbelo para una coincidencia más exacta con la voz elegida
Texto anterior y siguiente
Texto
Vacío
Pega las frases vecinas para suavizar la entonación entre fragmentos
💡 Consejo: cambia un ajuste por ejecución y lleva notas. Diez clips de prueba cortos te enseñan más sobre costo y calidad que una generación larga.
Pruébalo en Picasso IA
Tu próxima locución, banda sonora o transcripción no necesita una hoja de presupuesto el primer día. Abre la colección de texto a voz en Picasso IA, pega un guion corto en V3 y escucha el resultado en segundos. Luego pasa el mismo guion por otras dos voces y quédate con la que mejor encaje con tu público.
¿Estás creando un podcast, un curso o una demo de producto? Los modelos de imagen fotorrealista de la plataforma pueden crear las miniaturas, los banners y el arte de escena que acompañan a tu audio. Escribe un prompt, elige un modelo y mira qué sale. Explora todos los modelos de voz, música, transcripción e imagen en picassoia.com/en/all-models y empieza hoy mismo a experimentar con tus proyectos.