Alquilar una GPU para generar imágenes y video con IA parece sencillo hasta que llega la factura. Una plataforma anuncia $0.34 por hora, otra cobra por segundo y una tercera alquila máquinas sobrantes que pueden desaparecer a mitad de un render. El precio de catálogo apenas dice nada sobre lo que cuesta de verdad una imagen terminada o un clip de video de cinco segundos.
Esta comparativa pone frente a frente a RunPod, Vast.ai y Modal, convierte sus tarifas en costo por cada 1.000 imágenes y costo por clip de video, y muestra dónde gasta dinero cada una sin que lo notes. Todas las cifras de abajo se calculan a partir de tarifas publicadas, con los supuestos escritos junto a ellas para que puedas repetir las cuentas con tus propios números.
💡 Veredicto rápido: Vast.ai es la opción más barata por hora de GPU, RunPod ofrece el mejor equilibrio general y Modal es la opción más cómoda cuando tu tráfico es irregular y te sientes a gusto escribiendo Python.
La respuesta corta
El ranking depende de una sola pregunta: ¿tu GPU trabaja o espera? Una GPU ocupada favorece los alquileres por hora baratos. Una GPU que está casi siempre parada favorece la facturación serverless por segundo. Todas las cifras de este artículo salen de esa tensión, y explica por qué la plataforma "más barata" cambia según quién pregunte.

Precio por hora de un vistazo
Estas son las tarifas principales de las GPU que la gente usa de verdad para modelos de difusión y de video. Las cifras de RunPod y Modal proceden de sus listas de precios públicas a principios de octubre. Vast.ai es un mercado en el que cada anfitrión fija su precio, así que su columna muestra un rango típico y no una tarifa fija.
| GPU | RunPod Community | RunPod Secure | Modal | Vast.ai (típico) |
|---|
| RTX 4090 24GB | $0.34 | $0.74 | No ofrecida | $0.25 a $0.80 |
| L40S 48GB | $0.79 | $1.09 | $1.95 | Varía según el anfitrión |
| A100 80GB | $1.19 a $1.39 | $1.59 | $2.50 | $1.10 a $2.00 |
| H100 80GB | $1.99 a $2.69 | $2.89 a $3.49 | $3.95 | Alrededor de $1.50 a $3.00 |
Las instancias interrumpibles de Vast.ai bajan todavía más. Vast.ai las anuncia con un 50% o más de descuento frente al precio bajo demanda, y se han reportado ofertas de RTX 4090 en modo spot cerca de $0.15 por hora.
💡 Toma estas cifras como un ranking, no como una cotización. Los precios de las GPU cambian cada semana. Revisa el panel en vivo antes de comprometer un presupuesto.
Quién gana en cada trabajo
- Generación de imágenes por lotes: Vast.ai o RunPod Community. La tarifa por hora es baja y la GPU permanece ocupada.
- Generación de video: RunPod H100 o Vast.ai. Los trabajos largos se benefician de mucha memoria y una tarifa baja por hora.
- Tráfico de API irregular: Modal o RunPod Serverless. Solo pagas mientras se ejecuta una solicitud.
- Producción con promesas de disponibilidad: RunPod Secure Cloud o Modal. Menos sorpresas que un mercado.
- Primeros experimentos: Modal, porque el crédito gratuito mensual cubre miles de imágenes.
Tres plataformas, tres modelos mentales. Si eliges mal, pagarás por horas en las que tu GPU no hace nada.
RunPod: Pods y Serverless
RunPod ofrece dos productos. Los Pods son máquinas alquiladas que se facturan por segundo a una tarifa por hora. Community Cloud es el nivel más barato, y Secure Cloud funciona en centros de datos verificados con promesas de fiabilidad más sólidas. Serverless ejecuta tu contenedor bajo demanda, con workers flexibles que escalan a cero.
Serverless cuesta bastante más por hora que la misma tarjeta como pod. Una RTX 4090 cuesta $1.10 por hora en serverless frente a $0.34 como pod Community. Esa diferencia es el precio de no gestionar nada, y da una regla clara: un pod compensa frente a serverless solo si se mantiene ocupado más del 31% del tiempo, más o menos ($0.34 dividido entre $1.10).
Vast.ai: un mercado de GPU en tiempo real
Vast.ai no es dueño del hardware. Los anfitriones publican máquinas, fijan sus propios precios y tú alquilas la que encaje con tus filtros. La facturación es por segundo, sin mínimo, y hay tres modalidades: bajo demanda (garantizada, sin interrupciones), interrumpible (un 50% o más barata, puede recuperarse) y reservada (plazos de 1, 3 o 6 meses, hasta un 50% de descuento).

La ventaja son los precios más bajos de los tres. La contrapartida es la variabilidad. Un anfitrión en un garaje y otro en un centro de datos profesional aparecen en los mismos resultados de búsqueda, y los precios de ancho de banda y almacenamiento se fijan por anfitrión, así que lee el anuncio antes de alquilar. En lotes de imágenes que guardan cada resultado según avanzan, una interrupción casi no te cuesta nada. En un render de video de diez minutos, perder la instancia en el minuto nueve duele.
Modal: código primero, cobro por segundo
Modal no te entrega una máquina. Escribes funciones de Python, las etiquetas con un tipo de GPU y Modal las ejecuta en contenedores que arrancan bajo demanda. La facturación es por segundo: una L40S cuesta $0.000542 por segundo ($1.95 por hora), una H100 cuesta $0.001097 ($3.95 por hora), y el plan Starter incluye $30 de crédito gratuito cada mes.

La facturación con escalado a cero significa que nunca pagas por tiempo inactivo. También significa que nunca ves las tarifas horarias más baratas, porque el equivalente por hora de Modal es el más alto de los tres. Pagas un sobreprecio por la comodidad, y ese sobreprecio solo compensa cuando tu GPU, de no ser así, estaría parada la mayor parte del día.
Costo real por imagen
Los precios por hora son abstractos. Lo que importa es lo que cuesta una imagen terminada.
La matemática detrás de las cifras

La fórmula es sencilla: costo por imagen = (tarifa por hora ÷ 3.600) × segundos por imagen. Los segundos son la parte que varía. Los supuestos de trabajo aquí son una imagen de 1024 por 1024 píxeles de FLUX Dev con 28 pasos: unos 12 segundos en una RTX 4090, 9 segundos en una L40S, 4 segundos en una H100 y 4,5 segundos en la H100 PCIe, más lenta. Tus tiempos cambiarán según la cuantización, la resolución y la configuración de software, así que trata la tabla de abajo como un modelo que puedes volver a calcular.
También asume que la GPU ya está cargada y ocupada. El tiempo inactivo y la carga del modelo tienen su propia sección más abajo.
Ajustar la VRAM a tu modelo
La velocidad es solo la mitad de la historia, porque una tarjeta que no puede albergar el modelo no puede ejecutarlo en absoluto. En términos generales, una tarjeta de 24GB como la RTX 4090 maneja con holgura modelos de imagen de clase SDXL y de clase FLUX, sobre todo con pesos de 8 bits. Una tarjeta de 48GB como la L40S permite mantener cargados juntos el modelo de imagen, un ControlNet y un upscaler sin tener que intercambiarlos. Una A100 o H100 de 80GB es lo que necesitan los modelos grandes de video, porque mantienen en memoria secuencias largas de fotogramas a la vez.
La memoria afecta al precio de dos maneras. Comprar más VRAM de la que necesitas te cuesta dinero: ejecutar un modelo que necesita 20GB en una H100 te hace pagar 60GB que se quedan vacíos. Comprar muy poca te cuesta tiempo, porque el software descarga los pesos a la RAM del sistema y cada paso se ralentiza. Un buen hábito es alquilar la tarjeta más pequeña que quepa el modelo con unos gigas de margen, probar diez imágenes y solo entonces escalar.
💡 Prueba rápida: genera primero diez imágenes en una tarjeta barata. Si el tiempo por imagen está dentro de un 30% de lo que supusiste, la tabla de costos de abajo se sostendrá.
Costo por cada 1.000 imágenes
| Configuración | Tarifa por hora | Segundos por imagen | Costo por cada 1.000 imágenes |
|---|
| Vast.ai 4090, interrumpible | alrededor de $0.15 | 12 | $0.50 |
| RunPod 4090, pod Community | $0.34 | 12 | $1.13 |
| Vast.ai 4090, bajo demanda | alrededor de $0.40 | 12 | $1.33 |
| RunPod H100 PCIe, pod Community | $1.99 | 4,5 | $2.49 |
| RunPod 4090, Serverless | $1.10 | 12 | $3.67 |
| Modal H100 | $3.95 | 4 | $4.39 |
| Modal L40S | $1.95 | 9 | $4.88 |
Con una GPU perfectamente ocupada, una 4090 interrumpible de Vast.ai sale casi 10 veces más barata que una L40S de Modal. Ese es el titular, y también es engañoso. La utilización da la vuelta a la tabla. Una 4090 Community que trabaja solo el 10% del día cuesta en la práctica $11.33 por cada 1.000 imágenes, más del doble que los $4.88 de Modal, porque pagas también por el otro 90%.
El crédito gratuito de Modal hace fácil empezar a pequeña escala: $30 compran unas 15 horas de L40S, que son unas 6.000 imágenes de 9 segundos cada una, todos los meses, sin pagar nada.
Costo real por clip de video
Por qué el video cambia las cuentas
Los modelos de video son más pesados. Un clip de cinco segundos a 720p de un modelo como Wan 2.7 texto a video tarda minutos en lugar de segundos y necesita más VRAM, lo que te lleva de tarjetas de 24GB a otras de 48GB u 80GB. Los supuestos aquí son 6 minutos por clip en una tarjeta de clase 4090 o L40S con pesos cuantizados, y 3 minutos en una H100.

Los renders largos cambian el equilibrio. Una carga de modelo de 40 segundos apenas importa cuando el trabajo dura 6 minutos, así que los arranques en frío dejan de ser el enemigo. Las interrupciones pasan a serlo, porque una instancia perdida desperdicia minutos de trabajo en lugar de segundos. Eso desplaza el equilibrio hacia pods fiables y lejos de los listados interrumpibles más baratos.
Tabla de costo por clip
| Configuración | Minutos por clip | Costo por clip | Costo por cada 100 clips |
|---|
| RunPod 4090, pod Community | 6 | $0.03 | $3.40 |
| Vast.ai 4090, bajo demanda | 6 | $0.04 | $4.00 |
| RunPod H100 PCIe, pod Community | 3 | $0.10 | $9.95 |
| RunPod 4090, Serverless | 6 | $0.11 | $11.00 |
| Modal L40S | 6 | $0.20 | $19.51 |
| Modal H100 | 3 | $0.20 | $19.75 |
Incluso la fila más cara ronda los veinte centavos por clip. En video, la decisión no va de centavos por clip. Va de si las horas de configuración, la supervisión constante y los renders fallidos te cuestan más que la diferencia entre filas.
Costos ocultos que se comen tu presupuesto
Tiempo inactivo y arranques en frío
La forma más común de que una GPU barata se vuelva cara es olvidarse de apagarla. Una 4090 Community encendida todo el mes cuesta unos $248 ($0.34 por 730 horas). Un pod H100 PCIe encendido cuesta alrededor de $1.453. Ninguna de las dos produjo una sola imagen mientras dormías.

Serverless tiene el problema contrario. Un contenedor nuevo debe cargar varios gigabytes de pesos en la VRAM antes de que se ejecute la primera solicitud. Los modelos de imagen se cargan en segundos o decenas de segundos, y los modelos grandes de video tardan más. El tiempo que pasa cargando pesos dentro de tu función se factura como cualquier otro tiempo de cómputo, así que mantén los contenedores activos en las horas de mayor actividad y guarda los pesos en un volumen en lugar de descargarlos en cada arranque.
Almacenamiento, salida de datos y horas de configuración
💡 Regla general: una hora de tu propio tiempo cuesta más que una hora de cualquier GPU de esta lista.
Los pesos de los modelos suman rápido. Un modelo de imagen, un modelo de video y un puñado de LoRA llegan a 100 GB sin esfuerzo. El almacenamiento en red de RunPod cuesta entre $0.05 y $0.14 por GB al mes, así que 100 GB cuestan entre $5 y $14 mensuales, se cobren o no con un pod en marcha. Los anfitriones de Vast.ai fijan sus propias tarifas de almacenamiento y ancho de banda, así que compáralas listado por listado.
Luego están las horas de configuración. Instalar ComfyUI, hacer coincidir versiones de CUDA y depurar un anfitrión de mercado con un disco lento puede consumir una tarde entera. A una tarifa de $50 por hora, dos horas de solución de problemas cuestan $100, que equivalen al costo de cómputo de unas 88.000 imágenes en una 4090 Community. Las tarifas baratas por hora solo compensan si la máquina funciona a la primera.
Creadores independientes y aficionados

Si generas unos cientos de imágenes a la semana, empieza con el crédito gratuito de Modal y escribe un solo script. Si prefieres un flujo de trabajo visual como ComfyUI, alquila una 4090 Community de RunPod para una sesión de tarde y apágala al terminar. Vast.ai premia la paciencia y la comodidad con la consola: ordena por precio, revisa la puntuación de fiabilidad del anfitrión y usa las tarifas interrumpibles para lotes que se guardan mientras avanzan.
Equipos y APIs de producción

Un producto que atiende miles de solicitudes con tráfico irregular encaja en Modal o RunPod Serverless, donde pagas por segundo de trabajo real. Una carga constante y previsible encaja en los pods Secure de RunPod o en los términos reservados de Vast.ai, donde la tarifa por hora es la más baja por cada hora de uso real. Para video a gran escala, una H100 suele ganar en rendimiento por dólar aunque su tarifa por hora parezca dolorosa.
Si tu pipeline también llama a un modelo de lenguaje para escribir prompts, las mismas plataformas pueden servirlo, pero un modelo de tamaño completo como DeepSeek R1 necesita un nodo multi-GPU y puede duplicar la factura de hardware. Los modelos pequeños caben en una sola tarjeta de 24GB.
Cuándo alquilar una GPU no tiene sentido
Alquilar compensa cuando necesitas algo a medida: entrenamiento privado de LoRA, un grafo de ComfyUI poco habitual o un modelo que nadie aloja. Para todo lo demás, la matemática por hora, el riesgo de tiempo inactivo y el tiempo de configuración suelen hacer que un servicio alojado salga más barato en la práctica.

PicassoIA ejecuta sus propias GPU, con 91 modelos de texto a imagen y 87 modelos de texto a video disponibles, y la generación con sus propios modelos es gratuita en los planes Infinite y Wonder. No hay ningún contador en marcha mientras piensas en un prompt, ningún pod que olvidar y ningún error de CUDA a medianoche.
Cómo usar Flux en PicassoIA
- Abre la página del modelo. Empieza con FLUX Dev para una calidad equilibrada, o con FLUX Schnell cuando quieras borradores rápidos.
- Escribe un prompt específico. Indica el sujeto, la dirección de la luz y el objetivo, por ejemplo "85mm f/1.8, luz suave de ventana desde la izquierda".
- Elige la relación de aspecto. Usa 16:9 para cabeceras de blog y 1:1 para publicaciones en redes sociales.
- Ajusta los pasos y la guía si se muestran. Unos 28 pasos y un valor de guía cercano a 3,5 son un buen punto de partida para FLUX Dev.
- Genera y compara. Ejecuta el mismo prompt en FLUX.2 Pro cuando necesites un acabado extra.
- Mejora la nitidez del ganador. Pásalo por Clarity Pro Upscaler para obtener una versión de alta resolución limpia.
- Anímalo. Convierte el mejor fotograma en un clip corto con Wan 2.7 imagen a video o LTX 2 Fast.
💡 Consejo: mantén una sola plantilla de prompt para todas las imágenes de una serie. Usar la misma redacción de luz y objetivo te da un conjunto coherente sin configurar ninguna GPU.
Pruébalo tú mismo en PicassoIA
Ya tienes las cifras: Vast.ai para la tarifa por hora más baja, RunPod para el equilibrio, Modal para ráfagas de pago por segundo. Si prefieres saltarte los pods, los contenedores y las facturas, abre PicassoIA y ejecuta ahí tu próximo lote. Genera algunas imágenes con FLUX Dev, prueba un clip cinematográfico con Seedance 2.0 y compara los resultados con lo que ibas a alquilar una GPU para crear.
Experimenta con un prompt en tres modelos distintos, elige el estilo que más te guste y ahorra el costo de un pod inactivo para algo más divertido. Tu primera imagen está a solo unos clics.