Nano Banana Pro API en ComfyUI: nodos, flujo de trabajo y costo

Nano Banana Pro funciona dentro de ComfyUI como Partner Node, sin parchear Python ni crear un proyecto en Google Cloud. Este artículo repasa el nodo, un flujo de trabajo que funciona, los ajustes que cambian el precio y lo que cuestan los renders de 1K, 2K y 4K.

Nano Banana Pro API en ComfyUI: nodos, flujo de trabajo y costo
Cristian Da Conceicao
Fundador de Picasso IA

Si ya usas ComfyUI, añadir Nano Banana Pro lleva unos cinco minutos y un solo inicio de sesión. El modelo se distribuye como Partner Node, así que no hay entorno de Python que parchear, ni proyecto de Google Cloud que abrir, ni carga para tu propia GPU. Buscas el nodo, conectas un prompt y el modelo Gemini 3 Pro Image de Google genera hasta 4K nativo. Lo que más tiempo lleva es decidir dónde va el nodo dentro del grafo, qué ajustes mueven el precio y si los créditos de Comfy salen más baratos que llamar a Google directamente. Este artículo responde a las tres cosas con las cifras que Google y Comfy publican a fecha de octubre de 2026.

💡 Respuesta rápida sobre el costo: con el precio de lista de Google, una imagen de 1K y una de 2K cuestan lo mismo ($0.134), y una imagen de 4K cuesta $0.24. Haz los borradores en 2K, termina en 4K y nunca elijas 1K para ahorrar, porque no ahorra nada.

Qué hace el nodo de Nano Banana Pro

Nano Banana Pro es el nombre comercial de Gemini 3 Pro Image, que Google expone a través de la API de Gemini como gemini-3-pro-image-preview. No es un checkpoint que descargas. Es un modelo multimodal alojado en la nube, así que un solo nodo se encarga de texto a imagen, edición de imágenes y mezcla de varias imágenes. El trabajo pesado ocurre en el hardware de Google, mientras que ComfyUI solo envía la petición y guarda el resultado.

Gemini 3 Pro Image por dentro

Cuatro características importan cuando colocas este modelo en un grafo:

  • Salida 4K nativa. El modelo genera en 1K, 2K o 4K sin un paso aparte de escalado.
  • Hasta 14 imágenes de referencia. Rostros, productos, estilos y composiciones se pueden mezclar en una sola llamada.
  • Renderizado de texto en 10 idiomas. Carteles, etiquetas y rótulos salen mucho más legibles que con la mayoría de los checkpoints de difusión, según la publicación de lanzamiento de Comfy.
  • Inferencia alojada. No se carga nada en la VRAM, así que un equipo portátil sin GPU dedicada ejecuta el mismo grafo que una estación de trabajo.

Un detalle: Google no ofrece ningún nivel gratuito para este modelo en su API, así que cada llamada se cobra.

Partner Node o tu propia credencial

Hay tres formas de llegar al mismo modelo desde ComfyUI, y la correcta depende de a quién quieras enviar la factura.

RutaCuenta que necesitasFacturaciónIdeal para
ComfyUI Partner NodeCuenta de ComfyCréditos de ComfyConfiguración más rápida, solo hay que registrarse
Nodo de la comunidad con credencial de Google AI StudioCuenta de Google con plan de pagoGoogle cobra por imagenUsar la factura de Google y los precios Batch
Nodo de relay de tercerosCuenta del proveedor de relayPrecios del relayRegiones o métodos de pago que Google no atiende

Existen paquetes de la comunidad para la tercera ruta. ComfyUI-Nano-Banana-apiyi llama a Nano Banana Pro y a Nano Banana 2 sin una cuenta de Google Cloud, y el nodo "Luck" de Nano Banana Pro añade gestión de tiempos de espera y reintentos, progreso en vivo, modos de semilla nativos y hasta 14 entradas de imagen apiladas.

💡 Un nodo de relay ve cada prompt y cada foto de referencia que envías. Trátalo como cualquier servicio de terceros y reserva el trabajo con clientes o fotos privadas para la ruta oficial.

Un fotógrafo colocando la última de catorce fotografías de referencia impresas en una cuadrícula sobre una mesa de nogal

Prepara ComfyUI antes de empezar

Tres cosas deben cumplirse antes de que el nodo funcione: una versión actual de ComfyUI, una cuenta de Comfy con sesión iniciada y un saldo de créditos positivo. Lo demás es opcional.

Actualiza e inicia sesión

  1. Actualiza ComfyUI. Usa el actualizador de la aplicación de escritorio o renueva tu versión portátil. Las versiones antiguas no incluyen el nodo de Nano Banana Pro, y la documentación oficial te pide actualizar primero.
  2. Inicia sesión. Abre Ajustes, luego Usuario, e inicia sesión en tu cuenta de Comfy. Los Partner Nodes no se ejecutan sin ella.
  3. Compra créditos. Abre Ajustes y luego Créditos. Los Partner Nodes llaman a modelos de terceros de pago, así que el saldo tiene que ser mayor que cero. Los créditos mensuales caducan al terminar el periodo de facturación, mientras que los créditos de recarga duran un año desde la compra.

Un hombre con camisa de franela gris actualizando software en un equipo portátil sobre una isla de cocina con luz de la mañana

💡 La documentación de Comfy también menciona un entorno de red permitido y límites de concurrencia. Si el nodo falla solo en una VPN corporativa, prueba desde una conexión doméstica normal antes de depurar el grafo.

Abre la plantilla lista

Abre la Biblioteca de plantillas y elige la plantilla Nano Banana Pro. Los usuarios de Comfy Cloud pueden lanzar el mismo flujo desde Comfy Cloud sin instalar nada. La plantilla carga un grafo corto: un nodo LoadImage para una foto de referencia, el nodo Nano Banana Pro con tu prompt y un nodo SaveImage al final.

Sube una imagen de referencia, escribe un prompt, elige un nivel de razonamiento y pulsa Ejecutar. Luego revisa tu saldo de créditos. La diferencia es tu costo real para esa resolución, y es más fiable que cualquier tabla de este artículo, incluida la que aparece más abajo.

Construye el flujo nodo a nodo

La plantilla funciona, pero un grafo de producción suele necesitar más de tres nodos. Esto es lo que hace cada pieza y dónde se equivoca la gente.

Los cuatro nodos básicos

NodoFunciónCuidado con
LoadImageCarga una foto de referenciaLos archivos grandes tardan en subir
BatchImagesNodeUne varias imágenes en una sola entradaEl modelo ve un conjunto, así que nombra cada imagen en el prompt
Nano Banana Pro (GeminiImage2Node)Envía el prompt y las imágenes a Gemini 3 Pro ImageLa resolución aquí fija el precio
SaveImageGuarda el PNG en tu carpeta de salidaCambia el prefijo del nombre de archivo por proyecto o los archivos se acumulan

Vista desde abajo de dos monitores que muestran un grafo de nodos extenso junto a una vista previa de un paisaje de montaña

Ajustes que cambian el resultado

Los nombres de los campos varían un poco entre versiones de ComfyUI, pero las versiones actuales muestran estos controles:

  • Prompt. Escríbelo como un encargo fotográfico: sujeto, escenario, luz y objetivo. Las frases cortas y concretas funcionan mejor que las listas largas de etiquetas.
  • Relación de aspecto. Elige ya el lienzo final. Cambiarlo después implica pagar una imagen nueva completa.
  • Resolución. 1K, 2K o 4K. Es la palanca principal del precio.
  • Semilla. Sirve para repetir una ejecución, pero un modelo alojado no garantiza una salida idéntica píxel a píxel. Guarda los archivos que te gusten.
  • Nivel de razonamiento. La documentación enumera Minimal, High y Dynamic. Los niveles más altos ayudan con composiciones densas y textos largos.
  • Formato de respuesta. Elige solo imagen, salvo que también quieras el comentario de texto del modelo, ya que la salida de texto tiene un cargo propio, aunque pequeño.

Dedos girando el anillo de diafragma de un objetivo antiguo de 50 mm sobre una mesa de madera

Encadena entradas de varias referencias

El límite de 14 imágenes es donde este nodo se gana su sitio en un grafo. Un patrón repetible es este:

  1. Introduce primero la foto del sujeto y después las referencias de estilo y de objetos.
  2. Di para qué sirve cada imagen: "La imagen 1 es la persona, la imagen 2 es la chaqueta, la imagen 3 es la referencia de iluminación".
  3. Prueba combinaciones en 2K y repite la mejor en 4K.
  4. En trabajos de dos etapas, envía el primer resultado a un segundo nodo como única referencia y pide exactamente un cambio.

Cada imagen de entrada adicional cuesta unos $0.0011 al precio de lista de Google, así que 14 referencias suman unos $0.015 por llamada. Es lo bastante barato como para ser generoso, siempre que cada imagen tenga una función.

Una directora creativa clavando seis fotografías impresas de ambiente en una pared de corcho en un estudio luminoso

Redacta prompts con un modelo de lenguaje (LLM)

ComfyUI también incluye un nodo Google Gemini que puede describir imágenes y escribir prompts a partir de notas breves, así que el paso de redacción del prompt puede vivir dentro del mismo grafo. Si prefieres redactarlo fuera de ComfyUI, PicassoIA aloja Gemini 3.5 Flash para reescrituras rápidas y Claude Sonnet 5 para encargos más largos.

Pide al LLM un prompt en cuatro partes: sujeto y acción, entorno, iluminación, cámara y objetivo. Pega el resultado en el nodo y cambia una parte cada vez entre ejecuciones, para saber qué modificación movió la imagen.

Una mujer escribiendo una lista larga en una libreta de espiral junto a un equipo portátil en la ventana de una cafetería

El costo real de cada imagen

Precio oficial por resolución

La página de precios de la API de Gemini de Google, consultada el 6 de octubre de 2026, muestra estos precios para Gemini 3 Pro Image:

ModoImagen 1K o 2KImagen 4KImagen de entrada
Estándar$0.134$0.24$0.0011 cada una
Batch$0.067$0.12$0.0006 cada una

La publicación de lanzamiento de Comfy cita los mismos $0.134 y $0.24 para el Partner Node. Sin embargo, la página de precios de los Partner Nodes factura en créditos por token: 30.38 créditos por cada 1,000 tokens de imagen de salida, 0.5064 créditos por cada 1,000 tokens de entrada y 3.0384 créditos por cada 1,000 tokens de texto de salida.

Una imagen de 1K o 2K equivale a unos 1,120 tokens de salida y una de 4K unos 2,000, lo que da unos 34 créditos y 61 créditos antes de los cargos por entrada. Es mi cálculo a partir de la tabla publicada, así que confírmalo con tu propio saldo después de una prueba.

Un render en 4K cuesta alrededor de un 79% más que uno en 2K. Es un precio justo para trabajo de impresión o recortes intensos, y un desperdicio para la miniatura de un blog.

Tres formas de reducir la factura

  1. Haz los borradores en 2K, no en 1K. El precio es idéntico y obtienes más detalle para juzgar la composición y el texto.
  2. Termina en 4K solo las mejores. Tres borradores en 2K más un final en 4K cuestan $0.642 ($0.402 más $0.24), frente a $0.96 por cuatro intentos en 4K.
  3. Envía los trabajos masivos por la API Batch. Cuesta la mitad, pero los resultados llegan con retraso, y según la documentación el Partner Node de ComfyUI no lo expone. El trabajo en volumen pertenece a un script.
TrabajoEstándarBatch
100 imágenes en 2K$13.40$6.70
100 imágenes en 4K$24.00$12.00
500 imágenes en 2K$67.00$33.50

Una mano sosteniendo una calculadora sobre recibos en blanco, monedas de plata y una libreta en un escritorio de madera

Llamar a la API fuera de ComfyUI

A veces el nodo es la herramienta equivocada: trabajos nocturnos, miles de imágenes o una aplicación sin lienzo. El mismo modelo está disponible a través del SDK de google-genai de Google. Necesitas un proyecto con plan de pago en Google AI Studio, porque este modelo no tiene nivel gratuito.

Una llamada mínima en Python

from google import genai
from google.genai import types

client = genai.Client()  # reads your AI Studio credential from the environment

response = client.models.generate_content(
    model="gemini-3-pro-image-preview",
    contents=["Overhead photo of a walnut desk with a ceramic mug, soft window light"],
    config=types.GenerateContentConfig(
        response_modalities=["TEXT", "IMAGE"],
        image_config=types.ImageConfig(aspect_ratio="16:9", image_size="2K"),
    ),
)

for part in response.parts:
    if part.inline_data is not None:
        part.as_image().save("desk.png")

Hay dos detalles que hacen tropezar a la gente. image_size acepta "1K", "2K" o "4K" con la K en mayúscula, y las imágenes de referencia van en contents como elementos adicionales junto al prompt. Envuelve la llamada en un reintento con espera progresiva y registra cada respuesta, porque un prompt filtrado devuelve texto en lugar de una imagen.

Usa ComfyUI para iterar de forma interactiva y el SDK para el volumen. Ambos llegan al mismo modelo, así que un prompt que funciona en el lienzo funcionará en el script.

Las manos de un desarrollador sobre un equipo portátil en un despacho casero en penumbra al atardecer, con una lámpara cálida a la derecha

Errores frecuentes y soluciones rápidas

SíntomaCausa probableSolución
El nodo no aparece al buscarLa versión de ComfyUI está desactualizadaActualiza ComfyUI y reinicia la aplicación
La ejecución falla de inmediatoSin sesión iniciada o saldo de créditos en ceroRevisa Ajustes, Usuario y Ajustes, Créditos
No hay imagen, solo textoEl prompt fue filtrado o es demasiado vagoReescríbelo como un encargo fotográfico neutro
El texto de la imagen sale malCadenas largas o idiomas mezcladosPon las palabras exactas entre comillas y mantenlas cortas
La factura es mayor de lo previsto4K activado, muchos reintentos o muchas referenciasHaz borradores en 2K y limita los reintentos por trabajo
Las ejecuciones se encolan o fallan en masaLímites de concurrenciaEjecuta menos trabajos simultáneos

Usa Nano Banana Pro en PicassoIA

ComfyUI es el lugar adecuado cuando el modelo es un paso dentro de un grafo más largo. Para una sola imagen, una pestaña del navegador es más rápida. Nano Banana Pro en PicassoIA no necesita nodos, ni créditos de Comfy, ni código, y la página del modelo indica que se puede usar en línea de forma gratuita.

Paso a paso

  1. Abre la página del modelo Nano Banana Pro.
  2. Escribe el prompt como un encargo fotográfico: sujeto, escenario, luz, objetivo.
  3. Fija la resolución en 1K, 2K (la predeterminada) o 4K.
  4. Elige una relación de aspecto entre las 11 predefinidas, incluidas 16:9, 9:16, 4:5 y 21:9.
  5. Añade hasta 14 imágenes de referencia si quieres un sujeto o estilo concreto.
  6. Elige JPG o PNG. Deja el filtro de seguridad en su valor predeterminado, block_only_high, salvo que tu plataforma necesite un ajuste más estricto.
  7. Genera, revisa el resultado y cambia una sola cosa del prompt cada vez.

Una joven diseñadora sosteniendo una fotografía impresa de gran tamaño junto a una ventana iluminada por el sol

Alternativas que vale la pena probar

Ningún modelo gana con todos los prompts. Estos están en la misma colección de texto a imagen, así que una prueba lado a lado cuesta unos minutos.

ModeloPruébalo cuando
Nano Banana 2Quieras la familia Nano Banana en una versión más ligera para borradores rápidos
Seedream 4.5Quieras una segunda opinión de otro laboratorio para escenas de producto y estilo de vida
FLUX 2 ProQuieras un aspecto fotográfico de la línea de Black Forest Labs
GPT Image 2Tu prompt mezcla composición, texto e instrucciones precisas
Imagen 4Quieras otro modelo de Google para escenas limpias y realistas

PicassoIA también ofrece edición de imágenes, eliminación de fondo y superresolución para escalado de 2x a 4x, así que un render se puede corregir, recortar o ampliar sin salir de la plataforma.

Crea tu primera imagen hoy

Ya tienes el panorama completo: actualiza ComfyUI, inicia sesión, añade créditos, ejecuta la plantilla y vigila la resolución. Una primera prueba cuesta unos centavos, y aprenderás más de una ejecución real que de cualquier cantidad de lectura.

Si prefieres saltarte la configuración, abre Nano Banana Pro en PicassoIA, pega un prompt de este artículo y pulsa generar. Prueba el mismo encargo en 2K y en 4K, y luego compara los resultados con un segundo modelo de la tabla de arriba. Picasso IA hace que esa comparación sea rápida, así que el siguiente paso es sencillo: escribe un prompt, renderízalo y mira qué hace Nano Banana Pro con él.

Compartir este artículo

Elige tu idioma