Nano Banana Pro na API do ComfyUI: configuração, nós, fluxo de trabalho e custo

O Nano Banana Pro roda dentro do ComfyUI como um Partner Node, sem ajustes em Python e sem projeto no Google Cloud. Este artigo mostra o nó, um fluxo de trabalho que funciona, as configurações que mudam o preço e quanto custam as renderizações em 1K, 2K e 4K.

Nano Banana Pro na API do ComfyUI: configuração, nós, fluxo de trabalho e custo
Cristian Da Conceicao
Fundador do Picasso IA

Se você já usa o ComfyUI, adicionar o Nano Banana Pro leva cerca de cinco minutos e um login. O modelo vem como Partner Node, então não há ambiente Python para ajustar, nem projeto no Google Cloud para abrir, nem carga na sua própria GPU. Você procura o nó, conecta um prompt nele, e o modelo Gemini 3 Pro Image, do Google, renderiza até 4K nativo. O que leva mais tempo é decidir onde o nó fica no grafo, quais configurações mudam o preço e se os créditos do Comfy compensam mais do que chamar o Google diretamente. Este artigo responde às três perguntas com os números publicados pelo Google e pelo Comfy até outubro de 2026.

💡 Resposta rápida sobre custo: pelo preço de lista do Google, uma imagem 1K e uma 2K custam o mesmo (US$ 0,134), e uma imagem 4K custa US$ 0,24. Faça o rascunho em 2K, finalize em 4K e nunca escolha 1K para economizar, porque isso não economiza nada.

O que o nó Nano Banana Pro faz

Nano Banana Pro é o nome do produto para o Gemini 3 Pro Image, que o Google expõe pela API do Gemini como gemini-3-pro-image-preview. Não é um checkpoint que você baixa. É um modelo multimodal hospedado, então um único nó cuida de texto para imagem, edição de imagem e mistura de várias imagens. O trabalho pesado acontece no hardware do Google, enquanto o ComfyUI apenas envia a requisição e salva o resultado.

O Gemini 3 Pro Image por dentro

Quatro características importam quando você coloca este modelo dentro de um grafo:

  • Saída 4K nativa. O modelo renderiza em 1K, 2K ou 4K sem uma etapa separada de upscaling.
  • Até 14 imagens de referência. Rostos, produtos, estilos e layouts podem ser combinados em uma única chamada.
  • Renderização de texto em 10 idiomas. Cartazes, rótulos e placas saem bem mais legíveis do que com a maioria dos checkpoints de difusão, segundo o post de lançamento do Comfy.
  • Inferência hospedada. Nada é carregado na VRAM, então um notebook sem GPU dedicada roda o mesmo grafo que uma estação de trabalho.

Um porém: o Google não oferece nenhum plano gratuito para este modelo na API, então toda chamada é cobrada.

Partner Node ou sua própria credencial

Há três formas de chegar ao mesmo modelo a partir do ComfyUI, e a certa depende de para quem você quer enviar a fatura.

RotaConta necessáriaCobrançaMelhor para
Partner Node do ComfyUIConta do ComfyCréditos do ComfyConfiguração mais rápida, nada mais para cadastrar
Nó da comunidade com credencial do Google AI StudioConta Google em um plano pagoGoogle cobra por imagemUsar a fatura do próprio Google e o preço Batch
Nó de relay de terceirosConta no provedor do relayPreço do relayRegiões ou formas de pagamento que o Google não atende

Existem pacotes da comunidade para a terceira rota. O ComfyUI-Nano-Banana-apiyi chama o Nano Banana Pro e o Nano Banana 2 sem exigir uma conta no Google Cloud, e o nó "Luck" Nano Banana Pro acrescenta tratamento de timeout e nova tentativa, progresso ao vivo, modos nativos de seed e até 14 entradas de imagem combinadas.

💡 Um nó de relay vê cada prompt e cada foto de referência que você envia. Trate-o como qualquer serviço de terceiros e mantenha trabalhos de clientes ou fotos privadas na rota oficial.

Um fotógrafo colocando a última de quatorze fotografias de referência impressas em uma grade sobre uma mesa de nogueira

Configure o ComfyUI antes de começar

Três coisas precisam ser verdadeiras antes de o nó rodar: uma versão atual do ComfyUI, uma conta Comfy com login feito e saldo de créditos positivo. Todo o resto é opcional.

Atualize e faça login

  1. Atualize o ComfyUI. Use o atualizador do aplicativo de desktop ou atualize sua versão portátil. Versões antigas não incluem o nó Nano Banana Pro, e a documentação oficial pede que você atualize primeiro.
  2. Faça login. Abra Configurações, depois Usuário, e entre na sua conta Comfy. Os Partner Nodes não rodam sem isso.
  3. Compre créditos. Abra Configurações, depois Créditos. Os Partner Nodes chamam modelos pagos de terceiros, então o saldo precisa ser maior que zero. Os créditos mensais expiram quando o período de cobrança termina, enquanto os créditos avulsos valem por um ano a partir da compra.

Um homem de camisa de flanela cinza atualizando um software em um notebook sobre a bancada da cozinha, com luz da manhã

💡 A documentação do Comfy também menciona um ambiente de rede permitido e limites de concorrência. Se o nó falhar só numa VPN corporativa, teste a partir de uma conexão doméstica comum antes de depurar o grafo.

Abra o template pronto

Abra a Biblioteca de Templates e escolha o template Nano Banana Pro. Usuários da nuvem podem iniciar o mesmo fluxo no Comfy Cloud sem instalar nada. O template carrega um grafo curto: um nó LoadImage para uma foto de referência, o nó Nano Banana Pro com seu prompt e um nó SaveImage no final.

Envie uma imagem de referência, digite um prompt, escolha um nível de raciocínio e clique em Executar. Depois, confira seu saldo de créditos. A diferença é o seu custo real para aquela resolução, e ela é mais confiável do que qualquer tabela deste artigo, inclusive a que aparece mais adiante.

Monte o fluxo nó por nó

O template funciona, mas um grafo de produção geralmente precisa de mais do que três nós. Veja o que cada peça faz e onde as pessoas costumam errar.

Os quatro nós principais

NóFunçãoCuidado com
LoadImageTraz uma foto de referênciaArquivos grandes sobem devagar
BatchImagesNodeJunta várias imagens em uma única entradaO modelo vê um conjunto, então nomeie cada imagem no prompt
Nano Banana Pro (GeminiImage2Node)Envia o prompt e as imagens para o Gemini 3 Pro ImageA resolução aqui define o preço
SaveImageGrava o PNG na sua pasta de saídaMude o prefixo do nome de arquivo por projeto, senão os arquivos se acumulam

Vista em ângulo baixo de dois monitores mostrando um grafo de nós extenso ao lado de uma prévia de paisagem de montanha

Configurações que mudam o resultado

Os nomes dos campos variam um pouco entre versões do ComfyUI, mas as versões atuais expõem estes controles:

  • Prompt. Escreva como um briefing de foto: sujeito, cenário, luz e lente. Frases curtas e concretas funcionam melhor do que listas longas de tags.
  • Proporção. Defina a tela final agora. Mudar depois significa pagar por uma imagem nova e inteira.
  • Resolução. 1K, 2K ou 4K. Esta é a principal alavanca de preço.
  • Seed. Útil para repetir uma execução, mas um modelo hospedado não garante saída idêntica pixel a pixel. Salve os arquivos de que você gosta.
  • Nível de raciocínio. A documentação lista Minimal, High e Dynamic. Níveis mais altos ajudam em layouts densos e textos longos.
  • Formato de resposta. Escolha apenas imagem, a menos que também queira o comentário em texto do modelo, já que a saída de texto tem uma cobrança pequena à parte.

Dedos girando o anel de abertura de uma lente vintage de 50mm sobre uma mesa de madeira

Encadeie entradas com várias referências

O limite de 14 imagens é onde este nó ganha seu lugar em um grafo. Um padrão reaproveitável fica assim:

  1. Envie primeiro a foto do sujeito, depois as referências de estilo e de objetos.
  2. Diga para que serve cada imagem: "Imagem 1 é a pessoa, imagem 2 é a jaqueta, imagem 3 é a referência de iluminação".
  3. Teste combinações em 2K e depois repita a vencedora em 4K.
  4. Para trabalhos em duas etapas, envie a primeira saída para um segundo nó como única referência e peça exatamente uma mudança.

Cada imagem de entrada extra custa cerca de US$ 0,0011 pelo preço de lista do Google, então 14 referências somam aproximadamente US$ 0,015 por chamada. É barato o bastante para usar à vontade, desde que cada imagem tenha uma função.

Um diretor criativo prendendo seis fotografias impressas de referência de clima em um mural de cortiça em um estúdio iluminado

Rascunhe prompts com um LLM

O ComfyUI também traz um nó Google Gemini que pode legendar imagens e escrever prompts a partir de anotações rápidas, então a etapa de escrita do prompt pode ficar dentro do mesmo grafo. Se preferir rascunhar fora do ComfyUI, o PicassoIA hospeda o Gemini 3.5 Flash para reescritas rápidas e o Claude Sonnet 5 para briefings mais longos.

Peça ao LLM um prompt em quatro partes: sujeito e ação, ambiente, iluminação, câmera e lente. Cole o resultado no nó e mude uma parte de cada vez entre as execuções, para saber qual ajuste alterou a imagem.

Uma mulher escrevendo uma lista longa em um caderno espiral ao lado de um notebook, na janela de um café

O custo real de cada imagem

Preço oficial por resolução

A página de preços da API do Gemini do Google, consultada em 6 de outubro de 2026, lista estes preços para o Gemini 3 Pro Image:

ModoImagem 1K ou 2KImagem 4KImagem de entrada
PadrãoUS$ 0,134US$ 0,24US$ 0,0011 cada
BatchUS$ 0,067US$ 0,12US$ 0,0006 cada

O post de lançamento do Comfy cita os mesmos US$ 0,134 e US$ 0,24 para o Partner Node. Já a página de preços dos Partner Nodes cobra em créditos por token: 30,38 créditos por 1.000 tokens de imagem de saída, 0,5064 crédito por 1.000 tokens de entrada e 3,0384 créditos por 1.000 tokens de saída de texto.

Uma imagem 1K ou 2K tem em torno de 1.120 tokens de saída, e uma 4K tem cerca de 2.000, o que dá aproximadamente 34 créditos e 61 créditos, antes das cobranças de entrada. Esse é meu cálculo a partir da tabela publicada, então confirme com seu saldo depois de um teste.

Uma renderização 4K custa cerca de 79% a mais do que uma 2K. É um preço justo para trabalhos de impressão ou recortes pesados, e um desperdício para a miniatura de um blog.

Três formas de reduzir a conta

  1. Faça o rascunho em 2K, não em 1K. O preço é idêntico, e você ganha mais detalhe para julgar composição e texto.
  2. Finalize em 4K só as vencedoras. Três rascunhos em 2K mais uma versão final em 4K custam US$ 0,642 (US$ 0,402 mais US$ 0,24), contra US$ 0,96 de quatro tentativas em 4K.
  3. Mande trabalhos em volume pela Batch API. Custa a metade, mas os resultados chegam com atraso, e pelo que a documentação mostra, o Partner Node do ComfyUI não oferece essa opção. Trabalho em volume pertence a um script.
TrabalhoPadrãoBatch
100 imagens em 2KUS$ 13,40US$ 6,70
100 imagens em 4KUS$ 24,00US$ 12,00
500 imagens em 2KUS$ 67,00US$ 33,50

Uma mão segurando uma calculadora sobre recibos em branco, moedas de prata e um caderno em uma mesa de madeira

Chamando a API fora do ComfyUI

Às vezes o nó é a ferramenta errada: jobs noturnos, milhares de imagens ou um app sem tela de canvas. O mesmo modelo está disponível pelo SDK google-genai do Google. Você precisa de um projeto em plano pago no Google AI Studio, porque este modelo não tem plano gratuito.

Uma chamada mínima em Python

from google import genai
from google.genai import types

client = genai.Client()  # reads your AI Studio credential from the environment

response = client.models.generate_content(
    model="gemini-3-pro-image-preview",
    contents=["Overhead photo of a walnut desk with a ceramic mug, soft window light"],
    config=types.GenerateContentConfig(
        response_modalities=["TEXT", "IMAGE"],
        image_config=types.ImageConfig(aspect_ratio="16:9", image_size="2K"),
    ),
)

for part in response.parts:
    if part.inline_data is not None:
        part.as_image().save("desk.png")

Dois detalhes pegam as pessoas desprevenidas. image_size recebe "1K", "2K" ou "4K" com o K em maiúsculo, e as imagens de referência entram em contents como itens extras ao lado do prompt. Envolva a chamada em uma nova tentativa com backoff e registre cada resposta, porque um prompt filtrado devolve texto em vez de imagem.

Use o ComfyUI para iterar de forma interativa e o SDK para volume. As duas formas chegam ao mesmo modelo, então um prompt que funciona no canvas vai funcionar no script.

Mãos de um desenvolvedor sobre um notebook em um escritório doméstico escuro ao entardecer, com uma luminária quente à direita

Erros comuns e correções rápidas

SintomaCausa provávelCorreção
O nó não aparece na buscaA versão do ComfyUI está desatualizadaAtualize o ComfyUI e reinicie o aplicativo
A execução falha logo de inícioSem login, ou saldo de créditos zeradoConfira Configurações, Usuário e Configurações, Créditos
Sem imagem, só textoO prompt foi filtrado ou está vago demaisReescreva como um briefing de foto neutro
O texto na imagem está erradoStrings longas ou idiomas misturadosColoque as palavras exatas entre aspas e mantenha-as curtas
A conta veio maior que o previsto4K ligado, muitas novas tentativas ou muitas referênciasFaça o rascunho em 2K e limite as novas tentativas por job
Execuções entram em fila ou dão erro em volumeLimites de concorrênciaRode menos jobs simultâneos

Use o Nano Banana Pro no PicassoIA

O ComfyUI é o lugar certo quando o modelo é uma etapa de um grafo mais longo. Para uma imagem só, uma aba do navegador é mais rápida. O Nano Banana Pro no PicassoIA não precisa de nós, de créditos do Comfy nem de código, e a página do modelo indica que ele é gratuito para usar online.

Passo a passo

  1. Abra a página do modelo Nano Banana Pro.
  2. Escreva o prompt como um briefing de foto: sujeito, cenário, luz, lente.
  3. Defina a resolução como 1K, 2K (o padrão) ou 4K.
  4. Escolha uma proporção entre as 11 predefinições, incluindo 16:9, 9:16, 4:5 e 21:9.
  5. Adicione até 14 imagens de referência se quiser um sujeito ou estilo específico.
  6. Escolha JPG ou PNG. Deixe o filtro de segurança no padrão, block_only_high, a menos que sua plataforma exija uma configuração mais rígida.
  7. Gere, revise o resultado e mude uma coisa por vez no prompt.

Um jovem designer segurando uma fotografia grande impressa diante de uma janela ensolarada

Alternativas que valem o teste

Nenhum modelo vence em todos os prompts. Estes estão na mesma coleção de texto para imagem, então um teste lado a lado custa alguns minutos.

ModeloTeste quando
Nano Banana 2Você quer a família Nano Banana em uma versão mais leve para rascunhos rápidos
Seedream 4.5Você quer uma segunda opinião de outro laboratório para cenas de produto e de estilo de vida
FLUX 2 ProVocê quer um visual fotográfico da linha da Black Forest Labs
GPT Image 2Seu prompt mistura layout, texto e instruções precisas
Imagen 4Você quer outro modelo do Google para cenas limpas e realistas

O PicassoIA também oferece edição de imagens, remoção de fundo e super-resolução para upscaling de 2x a 4x, então uma renderização pode ser corrigida, recortada ou ampliada sem sair da plataforma.

Faça sua primeira imagem hoje

Agora você tem o quadro completo: atualize o ComfyUI, faça login, adicione créditos, rode o template e fique de olho na resolução. Um primeiro teste custa alguns centavos, e você aprende mais com uma execução real do que com qualquer quantidade de leitura.

Se preferir pular a configuração, abra o Nano Banana Pro no PicassoIA, cole um prompt deste artigo e clique em gerar. Teste o mesmo briefing em 2K e em 4K, depois compare os resultados com um segundo modelo da tabela acima. Picasso IA torna essa comparação rápida, então o próximo passo é simples: escreva um prompt, renderize e veja o que o Nano Banana Pro faz com ele.

Compartilhe este artigo

Escolha seu idioma