Precios de la API de ElevenLabs: costo, plan gratuito y límites de frecuencia explicados

Descubre cuánto cuesta realmente la API de ElevenLabs: tarifas por carácter de cada modelo de voz, créditos mensuales en los seis planes, qué permite el plan gratuito, límites de concurrencia por plan, tarifas de transcripción y música, presupuestos de ejemplo y formas de reducir la factura.

Precios de la API de ElevenLabs: costo, plan gratuito y límites de frecuencia explicados
Cristian Da Conceicao
Fundador de Picasso IA

Abres la página de precios de ElevenLabs y ves seis planes, un montón de créditos y unas cifras en dólares por cada mil caracteres. Luego abres tu primera factura y los números parecen distintos. La diferencia viene de tres cosas que la página reparte en varias pestañas: cómo convierte un modelo los caracteres en créditos, a qué plan pertenece tu cuenta y cuántas solicitudes puedes ejecutar al mismo tiempo. Este artículo reúne las tres en un solo lugar, con ejemplos resueltos, para que puedas estimar una factura antes de escribir una línea de código de integración.

💡 Comprobación de precios: todas las cifras de abajo se revisaron a principios de octubre de 2026. ElevenLabs cambia tarifas y lanza promociones con frecuencia, así que toma cada número como una instantánea y confírmalo en tu panel antes de destinar presupuesto.

Manos de un desarrollador escribiendo junto a un equipo portátil y una taza de café blanca con luz cálida de la mañana

Lo que la API cobra realmente

Créditos y dólares no son lo mismo

ElevenLabs mide el uso en dos monedas. Los planes de suscripción te dan un fondo mensual de créditos, y cada carácter generado gasta una parte de ellos según el modelo. La lista de precios de la API por uso se expresa en dólares por cada 1000 caracteres. Ambas describen el mismo audio, pero no se convierten una a una, por eso un cálculo mental rápido suele quedarse lejos de la cifra real.

En texto a voz la regla práctica es sencilla. Un modelo multilingüe como Multilingual v2 gasta alrededor de 1 crédito por carácter. Los modelos Flash y Turbo gastan entre 0,5 y 1 crédito por carácter, por eso son la opción económica para chatbots y agentes telefónicos.

Tarifas por modelo

Esta es la lista de precios por uso para texto a voz, por cada 1000 caracteres.

ModeloPrecio por 1000 caracteresUso habitual
Eleven v4$0.08 (promocional $0.022 hasta el 12 de octubre de 2026)Narración del modelo insignia
Eleven v4 Turbo$0.04 (promocional $0.011)Salida v4 más rápida y barata
Eleven v3$0.08Entrega expresiva y emotiva
v3 Conversational$0.04Diálogo de baja latencia
Multilingual v2$0.08Audiolibros y contenido largo
Flash v2.5 y Turbo v2.5$0.04Agentes en tiempo real, la latencia más baja

El descuento de la v4 termina pocos días después de esta comprobación, así que presupuesta con el precio de lista, no con el promocional.

Elegir entre estas filas depende sobre todo de lo que note quien escucha. Un video narrado o un audiolibro se reproduce una vez y se juzga por la emoción, así que los modelos de $0.08 justifican su precio. Un bot que responde "tu pedido ya fue enviado" mil veces al día se juzga por la velocidad, y un modelo de $0.04 que responde rápido gana a una voz más rica que obliga a esperar a quien llama. Muchos equipos usan ambos: un modelo premium para el contenido que la gente elige escuchar, y un modelo Flash para todo lo automatizado.

Tres ejemplos de costo

El inglés promedia unos 6 caracteres por palabra si cuentas los espacios y la puntuación, así que multiplica las palabras por 6 para una estimación rápida.

  • Capítulo de audiolibro, 10 000 palabras. Unos 60 000 caracteres. A $0.08 por 1000 son $4.80. En un modelo de $0.04 baja a $2.40.
  • Locución de un video de producto, 500 palabras. Unos 3000 caracteres, así que $0.24 a $0.08 o $0.12 a $0.04.
  • Bot de atención al cliente, 50 000 respuestas de 300 caracteres. Son 15 millones de caracteres: $600 a $0.04 por 1000, o $1200 a $0.08.

💡 Fórmula rápida: monthly cost = characters per month ÷ 1,000 × price per 1,000 characters. Hazlo dos veces, una con tu volumen mínimo esperado y otra con el máximo.

Vista cenital de una calculadora, una libreta con cifras escritas a mano y recibos sobre una mesa de nogal

Planes, créditos y costo mensual

Las suscripciones son la otra forma de pagar. Cada plan vende un fondo mensual fijo de créditos, además de extras como una licencia comercial, puestos para el equipo y mayor concurrencia.

Los seis planes comparados

PlanPrecio mensualCréditos mensualesMejor opción para
Free$010 000Pruebas y prototipos
Starter$630 000Creadores independientes, primer mes con descuento
Creator$22121 000Producción de contenido regular, primer mes con descuento
Pro$99600 000Productos pequeños y estudios
Scale$2991,8 millonesApps en crecimiento, tres puestos
Business$9906 millonesVolumen alto, diez puestos

La facturación anual equivale a dos meses gratis: pagas diez y usas doce. Los créditos no usados se acumulan durante hasta dos meses, con un tope de tres veces tu asignación mensual, siempre que la suscripción siga activa.

Costo por crédito según el plan

Divide el precio entre los créditos y los planes dejan de parecerse.

PlanPrecio efectivo por 1000 créditos
Starter$0.20
Creator$0.18
Pro$0.165
Scale$0.166
Business$0.165

Hay dos cosas que llaman la atención. El costo por crédito baja cerca de un 17 por ciento de Starter a Pro, y luego se estabiliza. A partir de Pro pagas por concurrencia, puestos y soporte, no por audio más barato.

El segundo punto importa más. Con 1 crédito por carácter, estas cifras quedan por encima de las tarifas por uso de la primera tabla. Las dos listas de precios se facturan de forma distinta, así que compara tu volumen previsto con ambas antes de elegir, y revisa en tu panel qué modo de facturación usa tu cuenta.

Tres presupuestos mensuales de ejemplo

Así quedan tres proyectos realistas si los calculas de las dos formas. La columna de uso por API usa las tarifas de lista de la primera tabla.

ProyectoCaracteres al mesCosto por usoPlan adecuado
YouTuber independiente, 8 videos de 1200 palabras57 600$4.61 a $0.08Creator, $22 por 121 000 créditos
Editorial de cursos, 40 lecciones de 1500 palabras360 000$28.80 a $0.08Pro, $99 por 600 000 créditos
Bot de voz, 500 000 respuestas de 250 caracteres125 millones$5000 a $0.04Contrato a medida, ya que Business llega como máximo a 6 millones de créditos

Si puedes comprar tarifas por uso en tu cuenta depende de tu configuración de facturación, así que lee esta tabla como una comparación, no como un presupuesto. El patrón se mantiene: los proyectos pequeños y medianos encajan cómodamente en un plan, mientras que un bot de alto volumen es una conversación comercial, no una compra en línea.

Vista desde arriba de cuatro desarrolladores trabajando alrededor de una mesa compartida en una oficina luminosa de startup

El plan gratuito en la práctica

Lo que dan 10 000 créditos

El plan Free te da 10 000 créditos cada mes por $0. Con un modelo que gasta 1 crédito por carácter, eso son 10 000 caracteres: unas 1700 palabras, o alrededor de 11 minutos de voz terminada a un ritmo normal de lectura. Con un modelo Flash, que gasta medio crédito por carácter, el mismo fondo da para unos 20 minutos.

Eso alcanza para tres tareas:

  • Elegir una voz para un proyecto
  • Comprobar que tu integración envía texto y recibe audio correctamente
  • Crear un prototipo para enseñárselo a un cliente o a un compañero de equipo

Límites que debes esperar

  • Sin licencia comercial. El audio que publiques o vendas necesita un plan de pago.
  • Concurrencia mínima. Dos solicitudes simultáneas en modelos multilingües y cuatro en Flash y Turbo.
  • Sin espacio para trabajos por lotes. Un capítulo de 10 000 palabras de 60 000 caracteres consumiría seis meses de créditos gratuitos.

Toma cualquiera de estos tres como señal para mejorar el plan. En el momento en que necesites publicar el audio con fines comerciales, ejecutar más de dos trabajos a la vez o generar más de unos 10 000 caracteres al mes, el plan gratuito deja de ser un plan y pasa a ser una prueba. Starter, a $6, es el primer escalón y triplica tus créditos mensuales mientras añade la licencia comercial.

💡 Consejo: gasta los créditos gratuitos en guiones de prueba de dos o tres frases, nunca en capítulos completos. Ajusta primero la voz, la velocidad y la estabilidad, y luego genera el texto completo una sola vez.

Vista desde abajo de un podcaster hablando frente a un micrófono en un estudio con paneles acústicos

Límites de frecuencia y concurrencia

Los límites de esta API tienen que ver sobre todo con la concurrencia: cuántas solicitudes se ejecutan al mismo tiempo, no cuántas envías por minuto. Un modelo rápido que termina en un segundo permite que un mismo espacio atienda muchas solicitudes. Una generación lenta y larga ocupa su espacio durante toda la ejecución.

Límites por plan

PlanMultilingual v2 y v3Flash y Turbo
Free24
Starter36
Creator510
Pro1020
Scale1530
Business1530

Estos son los límites publicados en el momento de escribir esto. Las cuentas empresariales tienen límites elevados, y los modelos más nuevos pueden tener techos propios, así que revísalo en el panel.

Si superas tu límite, la API pone la solicitud en cola, lo que añade un pequeño retraso, o devuelve un error HTTP 429. Prepárate para ambas cosas:

  1. Reintenta con espera exponencial.
  2. Añade una variación aleatoria (jitter) para que los reintentos no lleguen en oleada.
  3. Limita tú mismo las llamadas en curso con un semáforo (semaphore), fijado un poco por debajo del límite de tu plan.

Así se ve un envoltorio mínimo de reintentos en Python:

import random
import time

def with_backoff(call, retries=5, base=0.5):
    for attempt in range(retries):
        try:
            return call()
        except RateLimitError:
            time.sleep(base * 2 ** attempt + random.random() * 0.25)
    raise RuntimeError("still rate limited after retries")

Sustituye RateLimitError por la excepción que lance tu cliente HTTP ante un 429. La espera crece de medio segundo a ocho segundos, y la fracción aleatoria evita que los trabajadores paralelos reintenten al mismo ritmo.

Vista amplia de un pasillo con racks de servidores negros en un centro de datos

Cómo dimensionar tu concurrencia

Usa esta estimación:

concurrent requests ≈ requests per second × seconds per generation

Una app que alcanza 8 solicitudes por segundo con 1,5 segundos por generación necesita unos 12 espacios simultáneos. En modelos Flash eso cabe dentro de Pro, que permite 20.

Un agente de voz es distinto, porque cada llamada en vivo puede pedir voz al mismo tiempo. Con 25 personas que llaman a la vez en hora punta necesitas 25 espacios, y en modelos Flash solo Scale o Business (30) te dan ese margen. Los planes son baratos comparados con las llamadas perdidas, así que dimensiona para tu hora más cargada, no para la media.

Fila de agentes de atención al cliente con auriculares atendiendo llamadas en una oficina luminosa

Tarifas de transcripción y música

La voz es solo una parte de la factura. Si tu producto también convierte audio en texto o genera bandas sonoras, esos contadores también corren.

Scribe, voz a texto

La transcripción se cobra por hora de audio, no por carácter:

  • Scribe v2: $0.22 por hora para archivos
  • Scribe v2 Realtime: $0.39 por hora, con una latencia de unos 150 ms
  • Pistas de vocabulario: $0.05 por hora adicional
  • Edición de transcripciones: $0.07 por hora adicional

Un lote de 100 horas de entrevistas grabadas cuesta unos $22. Un evento en vivo de dos horas transcrito en tiempo real cuesta unos $0.78. Con esas tarifas, la transcripción es la partida más barata en la mayoría de los productos de audio, así que rara vez decide el plan. Si quieres una segunda opinión sobre la precisión, pasa el mismo archivo por GPT-4o Transcribe o Gemini 3 Pro y compara las transcripciones.

Joven con auriculares escuchando y tomando notas en un equipo portátil en una mesa de cafetería

Herramientas de música y voz

La generación de música se cobra a $0.15 por minuto de salida. Treinta pistas de tres minutos son 90 minutos, o $13.50. Voice Isolator y Voice Changer cuestan $0.12 por minuto cada uno.

La facturación por minuto hace que la música sea fácil de prever y fácil de gastar de más, porque cada reintento de un prompt se vuelve a cobrar. Escribe un encargo preciso, genera una muestra corta y solo después pide la duración completa. Puedes probar ElevenLabs Music en PicassoIA antes de conectarlo a tu código.

Manos apoyadas sobre los faders de una mesa de mezclas analógica en una sala de control con poca luz

Formas de reducir la factura

La mayoría de los ahorros vienen de enviar menos caracteres y de elegir modelos más baratos para cada tarea.

  • Elige el modelo según la tarea. Usa Flash para bots y alertas, y reserva los modelos premium para las narraciones en las que la emoción importa. Reducir a la mitad la tarifa del tráfico de bots suele ser el ahorro individual más grande.
  • Guarda en caché cada frase repetida. Los saludos, los menús de voz y los mensajes de error nunca cambian. Calcula un hash del texto, la voz y la configuración juntos, guarda el archivo de audio y sírvelo desde almacenamiento. Si el 40 por ciento de tus respuestas se repite, dejas de pagar por ese 40 por ciento.
  • Envía texto limpio. Quita el HTML, el marcado, las notas al pie y los espacios en blanco repetidos antes de la solicitud. Cada carácter se cobra.
  • Divide los guiones largos con contexto. Separa por saltos de párrafo y pasa las frases vecinas como contexto, para que el tono se mantenga coherente y una corrección de una línea no obligue a regenerar todo el guion.
  • Haz una vista previa antes de procesar por lotes. Genera un párrafo, escúchalo y luego genera el resto.
  • Pon un tope en tu propio código. Registra los caracteres por día, avisa al llegar al 80 por ciento del presupuesto y detente al 100.
  • Vigila los reintentos. Un bucle de reintentos que vuelve a enviar una solicitud que sí se completó te cobra dos veces. Etiqueta cada trabajo con un ID para detectar duplicados.
  • Simula la API en las pruebas. Un conjunto de pruebas que llama al endpoint real en cada commit gasta créditos en silencio. Graba una respuesta de muestra y reprodúcela en la integración continua.
  • Separa el desarrollo de la producción. Los entornos de staging, las demos y los experimentos usan el mismo fondo que tu producto en vivo. Dales una cuota pequeña o una cuenta dedicada, para que un bucle en un script de prueba no consuma la asignación del mes.
  • Audita mensualmente los guiones más grandes. Ordena las generaciones del mes pasado por número de caracteres. Unos pocos trabajos largos suelen explicar la mayor parte de la factura, y esos son los que vale la pena guardar en caché o acortar.

Editor de video con auriculares frente a un escritorio de doble monitor con luz dorada de la tarde

Prueba las voces en PicassoIA primero

Antes de conectar una API de pago a producción, prueba voces donde una elección equivocada no cuesta nada. PicassoIA aloja varios modelos de ElevenLabs en su colección de texto a voz, además de modelos de otros laboratorios, para que puedas comparar la entrega lado a lado. También ofrece ElevenLabs Dubbing para traducir videos a otros idiomas.

Modelos que vale la pena comparar

Paso a paso con V3

  1. Abre la página de Eleven v3 en la colección de texto a voz.
  2. Pega dos o tres frases de tu guion en el campo Prompt.
  3. Elige una voz. Hay 26 entre las que escoger, y la predeterminada es Rachel.
  4. Fija el código de idioma, como en, es o fr.
  5. Deja la estabilidad en 0,5 y el refuerzo de similitud en 0,75 para la primera ejecución.
  6. Genera, escucha, ajusta un solo parámetro cada vez y luego descarga el audio.

Ajustes que vale la pena cambiar

AjusteRangoPredeterminadoConsejo
Velocidad0,25 a 41Mantente entre 0,9 y 1,15 para una narración natural
Estilo0 a 10Prueba 0,2 a 0,4 para narrar historias. Los valores altos suenan teatrales
Estabilidad0 a 10,5Súbela para audiolibros largos, bájala para una entrega más variada
Refuerzo de similitud0 a 10,75Súbelo para una coincidencia más exacta con la voz elegida
Texto anterior y siguienteTextoVacíoPega las frases vecinas para suavizar la entonación entre fragmentos

💡 Consejo: cambia un ajuste por ejecución y lleva notas. Diez clips de prueba cortos te enseñan más sobre costo y calidad que una generación larga.

Pruébalo en Picasso IA

Tu próxima locución, banda sonora o transcripción no necesita una hoja de presupuesto el primer día. Abre la colección de texto a voz en Picasso IA, pega un guion corto en V3 y escucha el resultado en segundos. Luego pasa el mismo guion por otras dos voces y quédate con la que mejor encaje con tu público.

¿Estás creando un podcast, un curso o una demo de producto? Los modelos de imagen fotorrealista de la plataforma pueden crear las miniaturas, los banners y el arte de escena que acompañan a tu audio. Escribe un prompt, elige un modelo y mira qué sale. Explora todos los modelos de voz, música, transcripción e imagen en picassoia.com/en/all-models y empieza hoy mismo a experimentar con tus proyectos.

Compartir este artículo

Elige tu idioma