Precios de fal.ai: costos de la API, créditos gratis y MCP

fal.ai cobra por resultado: centavos por imagen, dólares por hora de GPU y hasta $0.40 por segundo de video, todo pagado con créditos prepagados. Este artículo recoge las tarifas actuales, explica la caducidad de los créditos y el límite de 2 solicitudes simultáneas, muestra cuánto cuesta el servidor MCP y compara las cuentas con un plan de tarifa plana.

Precios de fal.ai: costos de la API, créditos gratis y MCP
Cristian Da Conceicao
Fundador de Picasso IA

La mayoría de las páginas de precios te dicen cuánto cuesta una ejecución. Las preguntas que deciden tu presupuesto vienen después: cuántas ejecuciones caben en un mes, qué pasa con los créditos gratis que nunca usas y si el servidor MCP añade una tarifa sobre el modelo. Este artículo reúne en un solo lugar los precios publicados de fal.ai, revisados entre el 23 de septiembre y el 8 de octubre de 2026, y hace las cuentas para que puedas calcular un proyecto real antes de gastar un céntimo.

Resumen rápido: fal.ai funciona con prepago y cobra por resultado. Las imágenes van desde $0.003 por megapíxel hasta $0.15 por imagen, el video desde unos céntimos hasta $0.40 por segundo, las GPU se alquilan por hora y el servidor MCP en sí es gratuito. Solo pagas por las ejecuciones que dispara, a las mismas tarifas que una llamada directa a la API.

💡 Los precios cambian. Trata cada cifra de este artículo como una foto del momento. La página de un modelo, o la herramienta get_pricing dentro del servidor MCP, muestra el dato actualizado antes de que comprometas un presupuesto.

Cómo te cobra fal.ai

Créditos prepagados, cobro por resultado

fal funciona con un modelo de créditos prepagados. Sus términos indican que compras créditos por adelantado y que cada ejecución, ya sea desde la interfaz web o con una llamada a la API, descuenta su costo de tu saldo. Lo que te cobran por cada ejecución depende de lo que genere el modelo:

ResultadoUnidad de cobroEjemplo de la página de precios
ImágenesPor imagen o por megapíxel$0.0398 por imagen (Nano Banana)
VideoPor segundo o por video$0.14 por segundo (Kling Video v3)
Modelos de lenguaje y otrosPor petición o por segundo de cómputoVaría según el modelo
Cómputo brutoPor hora de GPU$2.49 a $4.50 por una H100

Contador de electricidad analógico sobre una pared de hormigón, una imagen de facturación por uso de fal.ai

Imagínalo como un contador de suministro, no como una suscripción. Si no se ejecuta nada, no se cobra nada. fal lo dice con sus propias palabras: solo pagas por la potencia de cómputo que consumes, y la documentación añade que pagas por los resultados exitosos, nunca por el tiempo de espera en la cola.

Concurrencia y ejecuciones fallidas

Dos reglas influyen en el costo real más que la tarifa principal.

  • La concurrencia empieza en 2. Una cuenta nueva puede tener 2 peticiones en curso a la vez. El límite sube automáticamente a medida que compras créditos, hasta 40. Si necesitas más, tienes que hablar con ventas.
  • Los errores casi siempre no tienen costo. Los errores del servidor (HTTP 500 o superior) nunca se cobran. Un error del cliente (HTTP 422) puede cobrarse si la GPU ya había empezado a trabajar antes de detectar el problema. El tiempo de arranque en frío en las API de modelos no se cobra, así que pagas solo por el tiempo de inferencia.

Supermercado con dos cajas, pero solo una abierta, una imagen del límite de 2 peticiones simultáneas

Hay otra regla que da problemas en producción. Cuando tu saldo cae por debajo del umbral de bloqueo de la cuenta, esta se bloquea y las peticiones a la API se rechazan hasta que añadas créditos. Si una aplicación atiende a clientes, pon un recordatorio de recarga bastante por encima de ese límite.

Precios de imagen por ejecución

Modelos económicos, precio por megapíxel

Los modelos de imagen económicos cobran según la resolución. Una imagen de 1024 por 1024 equivale a unos 1,05 megapíxeles (MP), y un fotograma de 1920 por 1080 a unos 2,07 MP.

ModeloPrecioCosto de una imagen de 1 MP
FLUX.1 schnell$0.003 por MPunos $0.003
Z Image Turbo$0.005 por MPunos $0.005
FLUX.2 dev$0.012 por MPunos $0.012
FLUX.2 pro$0.03 por el primer MP$0.03 o más

Las dos primeras filas proceden de la página de precios de fal. Las dos últimas, de una comparativa de precios fechada el 23 de septiembre de 2026. A $0.003 por MP, 1000 imágenes cuadradas cuestan más o menos $3.

Modelos premium, precio por imagen

Los modelos de gama alta prescinden del cálculo por megapíxel y cobran una cantidad fija por imagen. Algunos añaden además un nivel de calidad.

ModeloPrecio por imagen
Nano Banana$0.0398
Nano Banana Pro$0.15
GPT Image 2$0.006 baja, $0.053 media, $0.211 alta
Seedream 5 Lite$0.035
Seedream 5 Pro$0.0675
Qwen Image 3$0.04 a 1K

Fotógrafo con una hoja de contactos de fotogramas impresos, ilustración del costo de generar cada imagen

Si generas 1000 imágenes al mes, la diferencia es enorme:

💡 GPT Image 2 por sí solo cuesta unas 35 veces más en su ajuste alto que en el bajo. Elige el nivel según cada trabajo: borradores en bajo, versiones finales en alto.

Precios de video por segundo

Tarifas por segundo comparadas

El video es donde la factura crece, porque pagas por cada segundo de cada intento, incluidos los que descartas. Estas son las tarifas a 720p de la comparativa del 23 de septiembre, con y sin audio generado:

ModeloPor segundo, sin audioPor segundo, con audio
Veo 3.1 Lite$0.03$0.05
Veo 3.1 Fast$0.10$0.15
Veo 3.1$0.20$0.40
Kling v3 Standard$0.084$0.126
Kling v3 Pro$0.112$0.168
Wan 3$0.10no indicado
Grok Imagine Video 1.5$0.14no indicado
Seedance 2.0 Fastunos $0.24no indicado
Seedance 2.0unos $0.30no indicado

La propia página de precios de fal indica Kling Video v3 a $0.14 por segundo y Kling v2.5 a $0.07, lo que cae en el mismo rango que los niveles Standard y Pro de arriba. Seedance 2.0 se cobra por tokens ($0.014 por cada 1000 tokens), así que toda cifra por segundo para este modelo es una estimación que cambia según la resolución y la duración.

Escritorio de editor de video con un fotograma de montaña en pausa y un cronómetro, ilustración del costo de video por segundo

💡 El audio no es gratis. Duplica la tarifa de Veo 3.1, que pasa de $0.20 a $0.40 por segundo, y encarece en dos tercios Veo 3.1 Lite. Si la banda sonora viene de otra fuente, renderiza sin audio.

Tres presupuestos mensuales

Esto es lo que significan las tarifas anteriores para cargas de trabajo reales:

  1. 100 clips de 5 segundos en Kling v3. A $0.14 por segundo, cada clip cuesta $0.70, así que el mes sale por $70.
  2. Un clip de 8 segundos con audio. En Veo 3.1 son 8 x $0.40 = $3.20. En Veo 3.1 Lite son 8 x $0.05 = $0.40, ocho veces más barato.
  3. 1000 clips de 5 segundos con audio en Veo 3.1 Fast. Cada clip cuesta $0.75, así que el mes sale por $750.

Los reintentos son el multiplicador oculto. Si uno de cada tres clips no sirve, tu costo real por clip aprovechable es un 50 % más alto de lo que indica la tabla.

Tarifas de GPU por hora

Cuando ningún modelo alojado encaja, fal alquila GPU por hora. La página de precios muestra un rango para cada tarjeta:

GPUMemoriaTarifa por hora
RTX PRO 600096 GB$1.99 a $4.00
H10080 GB$2.49 a $4.50
H200141 GB$2.99 a $6.00
B200192 GB$5.49 a $7.99
GB200192 GB$5.89 a $9.99
B300288 GB$5.99 a $12.99

Pasillo tranquilo de un centro de datos con filas de racks de servidores, una imagen de las tarifas de GPU por hora

Un trabajo de 8 horas en una H100 cuesta entre $19.92 y $36. Si dejas esa misma tarjeta encendida todo el día durante un mes de 730 horas, la factura es de $1,817.70 en el extremo bajo y de $3,285 en el alto.

Compáralo con el precio por ejecución. Solo en precio, una H100 siempre encendida a $2.49 por hora solo supera a FLUX.1 schnell a $0.003 por imagen cuando pasas de unas 600 000 imágenes de un megapíxel al mes. Por debajo de esa cifra, cobrar por ejecución gana, y no necesita a nadie vigilando una máquina ociosa.

Créditos gratis y caducidad

Lo que recibe una cuenta nueva

fal da a las cuentas nuevas créditos de inicio para probar, pero la página de precios y la documentación no publican ninguna cantidad. Páginas de terceros lo describen como un número limitado de generaciones antes de añadir un método de pago, y la cifra cambia según las promociones. Cuenta con que la oferta sea pequeña.

Para ver hasta dónde llega un dólar con las tarifas anteriores:

  • Unas 333 imágenes de un megapíxel con FLUX.1 schnell
  • Unas 25 imágenes con Nano Banana
  • 4 clips de 5 segundos con audio en Veo 3.1 Lite
  • Unos 1,4 clips de 5 segundos en Kling v3

Mano deslizando una tarjeta prepagada sencilla sobre el mostrador de una cafetería, una imagen de los créditos gratis de fal.ai

💡 Gasta los créditos de prueba en el modelo que de verdad usarías en producción, no en el más barato. Una prueba con un modelo económico no dice nada sobre el costo de uno premium.

Cuándo caducan los créditos

Las normas de caducidad cambian según el tipo de crédito, y las dos páginas oficiales no coinciden en los créditos promocionales.

Tipo de créditoCaducidadReembolsable
Comprados365 días desde la compraNo, según las condiciones
Gratis o promocionales90 días según las condiciones, de 1 semana a 1 año según las preguntas frecuentesNo aplica

Calendario con días marcados en círculo y un reloj de arena, una imagen de la caducidad de los créditos de fal.ai

Las preguntas frecuentes dicen que los créditos gratis y los cupones tienen una caducidad variable según la concesión específica. Las condiciones dicen que los créditos promocionales caducan a los 90 días. Consulta la fecha de tu propia concesión en el panel de facturación y no compres un saldo grande que no puedas gastar en un año, ya que los créditos comprados solo sirven para consumo y no son reembolsables.

Cuánto cuesta el servidor MCP de fal

Cómo conectarlo

Nada. fal lo dice claramente: el servidor MCP es gratuito y solo pagas por las ejecuciones de modelos que disparas, a la tarifa estándar de fal. Se aplican los mismos límites de concurrencia que en las llamadas directas a la API, y el servidor no tiene estado, así que no guarda nada entre peticiones.

Hay dos vías documentadas. El endpoint https://mcp.fal.ai/mcp acepta un token de portador en la cabecera Authorization. El endpoint https://mcp.fal.ai/mcp-relay usa un inicio de sesión en el navegador, así que no hace falta token. Una configuración típica de cliente tiene este aspecto:

{
  "mcpServers": {
    "fal-ai": {
      "url": "https://mcp.fal.ai/mcp",
      "headers": { "Authorization": "Bearer YOUR_FAL_TOKEN" }
    }
  }
}

Funciona con Claude Code, Claude Desktop, Cursor, Windsurf, ChatGPT y Codex CLI. El asistente que hay detrás puede ser un modelo como Claude Sonnet 5 o Gemini 3.5 Flash. El modelo con el que chateas se cobra aparte de las ejecuciones de fal que dispara.

Mujer escribiendo en una cafetería iluminada por el sol mientras un asistente responde junto a miniaturas de fotos, una imagen del uso de fal.ai MCP

Herramientas que limitan tu gasto

El servidor expone unas nueve herramientas. Cuatro de ellas importan para controlar el costo:

HerramientaQué hace por tu presupuesto
get_pricingMuestra el precio de un modelo antes de generar
recommend_modelSugiere un modelo para la tarea que describes
run_modelEjecuta un modelo y espera hasta 45 segundos el resultado
submit_job y check_jobPonen en cola los trabajos largos y los consultan sin bloquear

Un agente puede encadenar una docena de ejecuciones a partir de una sola frase, y cada una se cobra. Dos hábitos mantienen eso bajo control. Pide al asistente que llame primero a get_pricing y que pregunte antes de cualquier ejecución por encima de un umbral que tú fijes. Y mantén un saldo prepagado modesto, porque una cuenta prepagada es un techo de gasto firme: cuando se acaba el dinero, la cuenta se bloquea.

Una alternativa de tarifa plana

El cobro por ejecución premia el uso ligero y penaliza la experimentación. El modelo opuesto es un plan con generaciones generosas o ilimitadas en ciertos modelos, y así lo plantea Picasso IA. Su página de precios incluye generaciones ilimitadas de PicassoIA Image en todos sus planes de pago, PicassoIA Video ilimitado en los planes Elite e Infinite, y uso ilimitado promocional de Seedance 2.5 Lite en esos mismos dos planes.

Diseñadora sosteniendo una fotografía impresa a contraluz de una ventana, una imagen de generación de imágenes sin medición

Modelos y límites

PicassoIA también tiene una API para desarrolladores y un conector MCP para Claude y ChatGPT. Cuatro modelos están disponibles por ambas vías:

ModeloFunción
PicassoIA ImageTexto a imagen
PicassoIA Image Editor ProEditar o combinar de 1 a 4 imágenes
PicassoIA VideoTexto o imagen a video
Seedance 2.5 LiteTexto o imagen a video con audio

Una cuenta puede tener 5 predicciones en cola o en ejecución a la vez, compartidas entre sus tokens de API y sus conexiones MCP. Los cuerpos de las peticiones están limitados a 10 MB y los prompts a 4000 caracteres. La referencia de la API dice que las predicciones de API son actualmente gratuitas y no usan créditos, pero también que crear predicciones requiere un plan Infinite, mientras que la página de precios incluye también el acceso a la API y las conexiones MCP en Elite. Revisa la tabla de planes antes de construir sobre ella.

Cómo llamar a la API

El flujo consta de crear, consultar y obtener. Sustituye el token por tu propio valor de pia_sk_:

curl -s -X POST https://api.picassoia.com/v1/models/picassoia/picassoia-image/predictions \
  -H "Authorization: Bearer $PICASSOIA_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"input": {"prompt": "a lighthouse at sunset, oil painting", "aspect_ratio": "16:9"}}'

La respuesta devuelve un id que empieza por api_, un status de starting y un eta con un tiempo de espera recomendado. Después, consulta GET /v1/predictions/{id} hasta que el estado sea succeeded, failed o canceled. Si todo sale bien, output contiene las URL de las imágenes. Entre las entradas opcionales están num_outputs (1 o 2), output_format (webp, jpg o png) y seed para obtener resultados repetibles.

Pruébalo sin contador

La forma más rápida de comparar es ejecutar el mismo prompt dos veces. Toma el prompt que ibas a enviar a una API de pago por uso, pégalo en PicassoIA Image y comprueba si el resultado es lo bastante bueno para evitar la factura por imagen. Después, pasa el ganador por PicassoIA Image Editor Pro para retocarlo y anímalo con Seedance 2.5 Lite si necesitas movimiento con sonido.

Abre Picasso IA, elige un modelo y crea tus propias imágenes hoy. Si más adelante tu proyecto necesita una API o una conexión MCP, los mismos modelos te esperan detrás.

Compartir este artículo

Elige tu idioma