Nano Banana Pro API en ComfyUI: nodos, flujo de trabajo y costo
Nano Banana Pro funciona dentro de ComfyUI como Partner Node, sin parchear Python ni crear un proyecto en Google Cloud. Este artículo repasa el nodo, un flujo de trabajo que funciona, los ajustes que cambian el precio y lo que cuestan los renders de 1K, 2K y 4K.
Si ya usas ComfyUI, añadir Nano Banana Pro lleva unos cinco minutos y un solo inicio de sesión. El modelo se distribuye como Partner Node, así que no hay entorno de Python que parchear, ni proyecto de Google Cloud que abrir, ni carga para tu propia GPU. Buscas el nodo, conectas un prompt y el modelo Gemini 3 Pro Image de Google genera hasta 4K nativo. Lo que más tiempo lleva es decidir dónde va el nodo dentro del grafo, qué ajustes mueven el precio y si los créditos de Comfy salen más baratos que llamar a Google directamente. Este artículo responde a las tres cosas con las cifras que Google y Comfy publican a fecha de octubre de 2026.
💡 Respuesta rápida sobre el costo: con el precio de lista de Google, una imagen de 1K y una de 2K cuestan lo mismo ($0.134), y una imagen de 4K cuesta $0.24. Haz los borradores en 2K, termina en 4K y nunca elijas 1K para ahorrar, porque no ahorra nada.
Qué hace el nodo de Nano Banana Pro
Nano Banana Pro es el nombre comercial de Gemini 3 Pro Image, que Google expone a través de la API de Gemini como gemini-3-pro-image-preview. No es un checkpoint que descargas. Es un modelo multimodal alojado en la nube, así que un solo nodo se encarga de texto a imagen, edición de imágenes y mezcla de varias imágenes. El trabajo pesado ocurre en el hardware de Google, mientras que ComfyUI solo envía la petición y guarda el resultado.
Gemini 3 Pro Image por dentro
Cuatro características importan cuando colocas este modelo en un grafo:
Salida 4K nativa. El modelo genera en 1K, 2K o 4K sin un paso aparte de escalado.
Hasta 14 imágenes de referencia. Rostros, productos, estilos y composiciones se pueden mezclar en una sola llamada.
Renderizado de texto en 10 idiomas. Carteles, etiquetas y rótulos salen mucho más legibles que con la mayoría de los checkpoints de difusión, según la publicación de lanzamiento de Comfy.
Inferencia alojada. No se carga nada en la VRAM, así que un equipo portátil sin GPU dedicada ejecuta el mismo grafo que una estación de trabajo.
Un detalle: Google no ofrece ningún nivel gratuito para este modelo en su API, así que cada llamada se cobra.
Partner Node o tu propia credencial
Hay tres formas de llegar al mismo modelo desde ComfyUI, y la correcta depende de a quién quieras enviar la factura.
Ruta
Cuenta que necesitas
Facturación
Ideal para
ComfyUI Partner Node
Cuenta de Comfy
Créditos de Comfy
Configuración más rápida, solo hay que registrarse
Nodo de la comunidad con credencial de Google AI Studio
Cuenta de Google con plan de pago
Google cobra por imagen
Usar la factura de Google y los precios Batch
Nodo de relay de terceros
Cuenta del proveedor de relay
Precios del relay
Regiones o métodos de pago que Google no atiende
Existen paquetes de la comunidad para la tercera ruta. ComfyUI-Nano-Banana-apiyi llama a Nano Banana Pro y a Nano Banana 2 sin una cuenta de Google Cloud, y el nodo "Luck" de Nano Banana Pro añade gestión de tiempos de espera y reintentos, progreso en vivo, modos de semilla nativos y hasta 14 entradas de imagen apiladas.
💡 Un nodo de relay ve cada prompt y cada foto de referencia que envías. Trátalo como cualquier servicio de terceros y reserva el trabajo con clientes o fotos privadas para la ruta oficial.
Prepara ComfyUI antes de empezar
Tres cosas deben cumplirse antes de que el nodo funcione: una versión actual de ComfyUI, una cuenta de Comfy con sesión iniciada y un saldo de créditos positivo. Lo demás es opcional.
Actualiza e inicia sesión
Actualiza ComfyUI. Usa el actualizador de la aplicación de escritorio o renueva tu versión portátil. Las versiones antiguas no incluyen el nodo de Nano Banana Pro, y la documentación oficial te pide actualizar primero.
Inicia sesión. Abre Ajustes, luego Usuario, e inicia sesión en tu cuenta de Comfy. Los Partner Nodes no se ejecutan sin ella.
Compra créditos. Abre Ajustes y luego Créditos. Los Partner Nodes llaman a modelos de terceros de pago, así que el saldo tiene que ser mayor que cero. Los créditos mensuales caducan al terminar el periodo de facturación, mientras que los créditos de recarga duran un año desde la compra.
💡 La documentación de Comfy también menciona un entorno de red permitido y límites de concurrencia. Si el nodo falla solo en una VPN corporativa, prueba desde una conexión doméstica normal antes de depurar el grafo.
Abre la plantilla lista
Abre la Biblioteca de plantillas y elige la plantilla Nano Banana Pro. Los usuarios de Comfy Cloud pueden lanzar el mismo flujo desde Comfy Cloud sin instalar nada. La plantilla carga un grafo corto: un nodo LoadImage para una foto de referencia, el nodo Nano Banana Pro con tu prompt y un nodo SaveImage al final.
Sube una imagen de referencia, escribe un prompt, elige un nivel de razonamiento y pulsa Ejecutar. Luego revisa tu saldo de créditos. La diferencia es tu costo real para esa resolución, y es más fiable que cualquier tabla de este artículo, incluida la que aparece más abajo.
Construye el flujo nodo a nodo
La plantilla funciona, pero un grafo de producción suele necesitar más de tres nodos. Esto es lo que hace cada pieza y dónde se equivoca la gente.
Los cuatro nodos básicos
Nodo
Función
Cuidado con
LoadImage
Carga una foto de referencia
Los archivos grandes tardan en subir
BatchImagesNode
Une varias imágenes en una sola entrada
El modelo ve un conjunto, así que nombra cada imagen en el prompt
Nano Banana Pro (GeminiImage2Node)
Envía el prompt y las imágenes a Gemini 3 Pro Image
La resolución aquí fija el precio
SaveImage
Guarda el PNG en tu carpeta de salida
Cambia el prefijo del nombre de archivo por proyecto o los archivos se acumulan
Ajustes que cambian el resultado
Los nombres de los campos varían un poco entre versiones de ComfyUI, pero las versiones actuales muestran estos controles:
Prompt. Escríbelo como un encargo fotográfico: sujeto, escenario, luz y objetivo. Las frases cortas y concretas funcionan mejor que las listas largas de etiquetas.
Relación de aspecto. Elige ya el lienzo final. Cambiarlo después implica pagar una imagen nueva completa.
Resolución. 1K, 2K o 4K. Es la palanca principal del precio.
Semilla. Sirve para repetir una ejecución, pero un modelo alojado no garantiza una salida idéntica píxel a píxel. Guarda los archivos que te gusten.
Nivel de razonamiento. La documentación enumera Minimal, High y Dynamic. Los niveles más altos ayudan con composiciones densas y textos largos.
Formato de respuesta. Elige solo imagen, salvo que también quieras el comentario de texto del modelo, ya que la salida de texto tiene un cargo propio, aunque pequeño.
Encadena entradas de varias referencias
El límite de 14 imágenes es donde este nodo se gana su sitio en un grafo. Un patrón repetible es este:
Introduce primero la foto del sujeto y después las referencias de estilo y de objetos.
Di para qué sirve cada imagen: "La imagen 1 es la persona, la imagen 2 es la chaqueta, la imagen 3 es la referencia de iluminación".
Prueba combinaciones en 2K y repite la mejor en 4K.
En trabajos de dos etapas, envía el primer resultado a un segundo nodo como única referencia y pide exactamente un cambio.
Cada imagen de entrada adicional cuesta unos $0.0011 al precio de lista de Google, así que 14 referencias suman unos $0.015 por llamada. Es lo bastante barato como para ser generoso, siempre que cada imagen tenga una función.
Redacta prompts con un modelo de lenguaje (LLM)
ComfyUI también incluye un nodo Google Gemini que puede describir imágenes y escribir prompts a partir de notas breves, así que el paso de redacción del prompt puede vivir dentro del mismo grafo. Si prefieres redactarlo fuera de ComfyUI, PicassoIA aloja Gemini 3.5 Flash para reescrituras rápidas y Claude Sonnet 5 para encargos más largos.
Pide al LLM un prompt en cuatro partes: sujeto y acción, entorno, iluminación, cámara y objetivo. Pega el resultado en el nodo y cambia una parte cada vez entre ejecuciones, para saber qué modificación movió la imagen.
El costo real de cada imagen
Precio oficial por resolución
La página de precios de la API de Gemini de Google, consultada el 6 de octubre de 2026, muestra estos precios para Gemini 3 Pro Image:
Modo
Imagen 1K o 2K
Imagen 4K
Imagen de entrada
Estándar
$0.134
$0.24
$0.0011 cada una
Batch
$0.067
$0.12
$0.0006 cada una
La publicación de lanzamiento de Comfy cita los mismos $0.134 y $0.24 para el Partner Node. Sin embargo, la página de precios de los Partner Nodes factura en créditos por token: 30.38 créditos por cada 1,000 tokens de imagen de salida, 0.5064 créditos por cada 1,000 tokens de entrada y 3.0384 créditos por cada 1,000 tokens de texto de salida.
Una imagen de 1K o 2K equivale a unos 1,120 tokens de salida y una de 4K unos 2,000, lo que da unos 34 créditos y 61 créditos antes de los cargos por entrada. Es mi cálculo a partir de la tabla publicada, así que confírmalo con tu propio saldo después de una prueba.
Un render en 4K cuesta alrededor de un 79% más que uno en 2K. Es un precio justo para trabajo de impresión o recortes intensos, y un desperdicio para la miniatura de un blog.
Tres formas de reducir la factura
Haz los borradores en 2K, no en 1K. El precio es idéntico y obtienes más detalle para juzgar la composición y el texto.
Termina en 4K solo las mejores. Tres borradores en 2K más un final en 4K cuestan $0.642 ($0.402 más $0.24), frente a $0.96 por cuatro intentos en 4K.
Envía los trabajos masivos por la API Batch. Cuesta la mitad, pero los resultados llegan con retraso, y según la documentación el Partner Node de ComfyUI no lo expone. El trabajo en volumen pertenece a un script.
Trabajo
Estándar
Batch
100 imágenes en 2K
$13.40
$6.70
100 imágenes en 4K
$24.00
$12.00
500 imágenes en 2K
$67.00
$33.50
Llamar a la API fuera de ComfyUI
A veces el nodo es la herramienta equivocada: trabajos nocturnos, miles de imágenes o una aplicación sin lienzo. El mismo modelo está disponible a través del SDK de google-genai de Google. Necesitas un proyecto con plan de pago en Google AI Studio, porque este modelo no tiene nivel gratuito.
Una llamada mínima en Python
from google import genai
from google.genai import types
client = genai.Client() # reads your AI Studio credential from the environment
response = client.models.generate_content(
model="gemini-3-pro-image-preview",
contents=["Overhead photo of a walnut desk with a ceramic mug, soft window light"],
config=types.GenerateContentConfig(
response_modalities=["TEXT", "IMAGE"],
image_config=types.ImageConfig(aspect_ratio="16:9", image_size="2K"),
),
)
for part in response.parts:
if part.inline_data is not None:
part.as_image().save("desk.png")
Hay dos detalles que hacen tropezar a la gente. image_size acepta "1K", "2K" o "4K" con la K en mayúscula, y las imágenes de referencia van en contents como elementos adicionales junto al prompt. Envuelve la llamada en un reintento con espera progresiva y registra cada respuesta, porque un prompt filtrado devuelve texto en lugar de una imagen.
Usa ComfyUI para iterar de forma interactiva y el SDK para el volumen. Ambos llegan al mismo modelo, así que un prompt que funciona en el lienzo funcionará en el script.
Errores frecuentes y soluciones rápidas
Síntoma
Causa probable
Solución
El nodo no aparece al buscar
La versión de ComfyUI está desactualizada
Actualiza ComfyUI y reinicia la aplicación
La ejecución falla de inmediato
Sin sesión iniciada o saldo de créditos en cero
Revisa Ajustes, Usuario y Ajustes, Créditos
No hay imagen, solo texto
El prompt fue filtrado o es demasiado vago
Reescríbelo como un encargo fotográfico neutro
El texto de la imagen sale mal
Cadenas largas o idiomas mezclados
Pon las palabras exactas entre comillas y mantenlas cortas
La factura es mayor de lo previsto
4K activado, muchos reintentos o muchas referencias
Haz borradores en 2K y limita los reintentos por trabajo
Las ejecuciones se encolan o fallan en masa
Límites de concurrencia
Ejecuta menos trabajos simultáneos
Usa Nano Banana Pro en PicassoIA
ComfyUI es el lugar adecuado cuando el modelo es un paso dentro de un grafo más largo. Para una sola imagen, una pestaña del navegador es más rápida. Nano Banana Pro en PicassoIA no necesita nodos, ni créditos de Comfy, ni código, y la página del modelo indica que se puede usar en línea de forma gratuita.
Paso a paso
Abre la página del modelo Nano Banana Pro.
Escribe el prompt como un encargo fotográfico: sujeto, escenario, luz, objetivo.
Fija la resolución en 1K, 2K (la predeterminada) o 4K.
Elige una relación de aspecto entre las 11 predefinidas, incluidas 16:9, 9:16, 4:5 y 21:9.
Añade hasta 14 imágenes de referencia si quieres un sujeto o estilo concreto.
Elige JPG o PNG. Deja el filtro de seguridad en su valor predeterminado, block_only_high, salvo que tu plataforma necesite un ajuste más estricto.
Genera, revisa el resultado y cambia una sola cosa del prompt cada vez.
Alternativas que vale la pena probar
Ningún modelo gana con todos los prompts. Estos están en la misma colección de texto a imagen, así que una prueba lado a lado cuesta unos minutos.
Quieras otro modelo de Google para escenas limpias y realistas
PicassoIA también ofrece edición de imágenes, eliminación de fondo y superresolución para escalado de 2x a 4x, así que un render se puede corregir, recortar o ampliar sin salir de la plataforma.
Crea tu primera imagen hoy
Ya tienes el panorama completo: actualiza ComfyUI, inicia sesión, añade créditos, ejecuta la plantilla y vigila la resolución. Una primera prueba cuesta unos centavos, y aprenderás más de una ejecución real que de cualquier cantidad de lectura.
Si prefieres saltarte la configuración, abre Nano Banana Pro en PicassoIA, pega un prompt de este artículo y pulsa generar. Prueba el mismo encargo en 2K y en 4K, y luego compara los resultados con un segundo modelo de la tabla de arriba. Picasso IA hace que esa comparación sea rápida, así que el siguiente paso es sencillo: escribe un prompt, renderízalo y mira qué hace Nano Banana Pro con él.