Nano Banana Pro na API do ComfyUI: configuração, nós, fluxo de trabalho e custo
O Nano Banana Pro roda dentro do ComfyUI como um Partner Node, sem ajustes em Python e sem projeto no Google Cloud. Este artigo mostra o nó, um fluxo de trabalho que funciona, as configurações que mudam o preço e quanto custam as renderizações em 1K, 2K e 4K.
Se você já usa o ComfyUI, adicionar o Nano Banana Pro leva cerca de cinco minutos e um login. O modelo vem como Partner Node, então não há ambiente Python para ajustar, nem projeto no Google Cloud para abrir, nem carga na sua própria GPU. Você procura o nó, conecta um prompt nele, e o modelo Gemini 3 Pro Image, do Google, renderiza até 4K nativo. O que leva mais tempo é decidir onde o nó fica no grafo, quais configurações mudam o preço e se os créditos do Comfy compensam mais do que chamar o Google diretamente. Este artigo responde às três perguntas com os números publicados pelo Google e pelo Comfy até outubro de 2026.
💡 Resposta rápida sobre custo: pelo preço de lista do Google, uma imagem 1K e uma 2K custam o mesmo (US$ 0,134), e uma imagem 4K custa US$ 0,24. Faça o rascunho em 2K, finalize em 4K e nunca escolha 1K para economizar, porque isso não economiza nada.
O que o nó Nano Banana Pro faz
Nano Banana Pro é o nome do produto para o Gemini 3 Pro Image, que o Google expõe pela API do Gemini como gemini-3-pro-image-preview. Não é um checkpoint que você baixa. É um modelo multimodal hospedado, então um único nó cuida de texto para imagem, edição de imagem e mistura de várias imagens. O trabalho pesado acontece no hardware do Google, enquanto o ComfyUI apenas envia a requisição e salva o resultado.
O Gemini 3 Pro Image por dentro
Quatro características importam quando você coloca este modelo dentro de um grafo:
Saída 4K nativa. O modelo renderiza em 1K, 2K ou 4K sem uma etapa separada de upscaling.
Até 14 imagens de referência. Rostos, produtos, estilos e layouts podem ser combinados em uma única chamada.
Renderização de texto em 10 idiomas. Cartazes, rótulos e placas saem bem mais legíveis do que com a maioria dos checkpoints de difusão, segundo o post de lançamento do Comfy.
Inferência hospedada. Nada é carregado na VRAM, então um notebook sem GPU dedicada roda o mesmo grafo que uma estação de trabalho.
Um porém: o Google não oferece nenhum plano gratuito para este modelo na API, então toda chamada é cobrada.
Partner Node ou sua própria credencial
Há três formas de chegar ao mesmo modelo a partir do ComfyUI, e a certa depende de para quem você quer enviar a fatura.
Rota
Conta necessária
Cobrança
Melhor para
Partner Node do ComfyUI
Conta do Comfy
Créditos do Comfy
Configuração mais rápida, nada mais para cadastrar
Nó da comunidade com credencial do Google AI Studio
Conta Google em um plano pago
Google cobra por imagem
Usar a fatura do próprio Google e o preço Batch
Nó de relay de terceiros
Conta no provedor do relay
Preço do relay
Regiões ou formas de pagamento que o Google não atende
Existem pacotes da comunidade para a terceira rota. O ComfyUI-Nano-Banana-apiyi chama o Nano Banana Pro e o Nano Banana 2 sem exigir uma conta no Google Cloud, e o nó "Luck" Nano Banana Pro acrescenta tratamento de timeout e nova tentativa, progresso ao vivo, modos nativos de seed e até 14 entradas de imagem combinadas.
💡 Um nó de relay vê cada prompt e cada foto de referência que você envia. Trate-o como qualquer serviço de terceiros e mantenha trabalhos de clientes ou fotos privadas na rota oficial.
Configure o ComfyUI antes de começar
Três coisas precisam ser verdadeiras antes de o nó rodar: uma versão atual do ComfyUI, uma conta Comfy com login feito e saldo de créditos positivo. Todo o resto é opcional.
Atualize e faça login
Atualize o ComfyUI. Use o atualizador do aplicativo de desktop ou atualize sua versão portátil. Versões antigas não incluem o nó Nano Banana Pro, e a documentação oficial pede que você atualize primeiro.
Faça login. Abra Configurações, depois Usuário, e entre na sua conta Comfy. Os Partner Nodes não rodam sem isso.
Compre créditos. Abra Configurações, depois Créditos. Os Partner Nodes chamam modelos pagos de terceiros, então o saldo precisa ser maior que zero. Os créditos mensais expiram quando o período de cobrança termina, enquanto os créditos avulsos valem por um ano a partir da compra.
💡 A documentação do Comfy também menciona um ambiente de rede permitido e limites de concorrência. Se o nó falhar só numa VPN corporativa, teste a partir de uma conexão doméstica comum antes de depurar o grafo.
Abra o template pronto
Abra a Biblioteca de Templates e escolha o template Nano Banana Pro. Usuários da nuvem podem iniciar o mesmo fluxo no Comfy Cloud sem instalar nada. O template carrega um grafo curto: um nó LoadImage para uma foto de referência, o nó Nano Banana Pro com seu prompt e um nó SaveImage no final.
Envie uma imagem de referência, digite um prompt, escolha um nível de raciocínio e clique em Executar. Depois, confira seu saldo de créditos. A diferença é o seu custo real para aquela resolução, e ela é mais confiável do que qualquer tabela deste artigo, inclusive a que aparece mais adiante.
Monte o fluxo nó por nó
O template funciona, mas um grafo de produção geralmente precisa de mais do que três nós. Veja o que cada peça faz e onde as pessoas costumam errar.
Os quatro nós principais
Nó
Função
Cuidado com
LoadImage
Traz uma foto de referência
Arquivos grandes sobem devagar
BatchImagesNode
Junta várias imagens em uma única entrada
O modelo vê um conjunto, então nomeie cada imagem no prompt
Nano Banana Pro (GeminiImage2Node)
Envia o prompt e as imagens para o Gemini 3 Pro Image
A resolução aqui define o preço
SaveImage
Grava o PNG na sua pasta de saída
Mude o prefixo do nome de arquivo por projeto, senão os arquivos se acumulam
Configurações que mudam o resultado
Os nomes dos campos variam um pouco entre versões do ComfyUI, mas as versões atuais expõem estes controles:
Prompt. Escreva como um briefing de foto: sujeito, cenário, luz e lente. Frases curtas e concretas funcionam melhor do que listas longas de tags.
Proporção. Defina a tela final agora. Mudar depois significa pagar por uma imagem nova e inteira.
Resolução. 1K, 2K ou 4K. Esta é a principal alavanca de preço.
Seed. Útil para repetir uma execução, mas um modelo hospedado não garante saída idêntica pixel a pixel. Salve os arquivos de que você gosta.
Nível de raciocínio. A documentação lista Minimal, High e Dynamic. Níveis mais altos ajudam em layouts densos e textos longos.
Formato de resposta. Escolha apenas imagem, a menos que também queira o comentário em texto do modelo, já que a saída de texto tem uma cobrança pequena à parte.
Encadeie entradas com várias referências
O limite de 14 imagens é onde este nó ganha seu lugar em um grafo. Um padrão reaproveitável fica assim:
Envie primeiro a foto do sujeito, depois as referências de estilo e de objetos.
Diga para que serve cada imagem: "Imagem 1 é a pessoa, imagem 2 é a jaqueta, imagem 3 é a referência de iluminação".
Teste combinações em 2K e depois repita a vencedora em 4K.
Para trabalhos em duas etapas, envie a primeira saída para um segundo nó como única referência e peça exatamente uma mudança.
Cada imagem de entrada extra custa cerca de US$ 0,0011 pelo preço de lista do Google, então 14 referências somam aproximadamente US$ 0,015 por chamada. É barato o bastante para usar à vontade, desde que cada imagem tenha uma função.
Rascunhe prompts com um LLM
O ComfyUI também traz um nó Google Gemini que pode legendar imagens e escrever prompts a partir de anotações rápidas, então a etapa de escrita do prompt pode ficar dentro do mesmo grafo. Se preferir rascunhar fora do ComfyUI, o PicassoIA hospeda o Gemini 3.5 Flash para reescritas rápidas e o Claude Sonnet 5 para briefings mais longos.
Peça ao LLM um prompt em quatro partes: sujeito e ação, ambiente, iluminação, câmera e lente. Cole o resultado no nó e mude uma parte de cada vez entre as execuções, para saber qual ajuste alterou a imagem.
O custo real de cada imagem
Preço oficial por resolução
A página de preços da API do Gemini do Google, consultada em 6 de outubro de 2026, lista estes preços para o Gemini 3 Pro Image:
Modo
Imagem 1K ou 2K
Imagem 4K
Imagem de entrada
Padrão
US$ 0,134
US$ 0,24
US$ 0,0011 cada
Batch
US$ 0,067
US$ 0,12
US$ 0,0006 cada
O post de lançamento do Comfy cita os mesmos US$ 0,134 e US$ 0,24 para o Partner Node. Já a página de preços dos Partner Nodes cobra em créditos por token: 30,38 créditos por 1.000 tokens de imagem de saída, 0,5064 crédito por 1.000 tokens de entrada e 3,0384 créditos por 1.000 tokens de saída de texto.
Uma imagem 1K ou 2K tem em torno de 1.120 tokens de saída, e uma 4K tem cerca de 2.000, o que dá aproximadamente 34 créditos e 61 créditos, antes das cobranças de entrada. Esse é meu cálculo a partir da tabela publicada, então confirme com seu saldo depois de um teste.
Uma renderização 4K custa cerca de 79% a mais do que uma 2K. É um preço justo para trabalhos de impressão ou recortes pesados, e um desperdício para a miniatura de um blog.
Três formas de reduzir a conta
Faça o rascunho em 2K, não em 1K. O preço é idêntico, e você ganha mais detalhe para julgar composição e texto.
Finalize em 4K só as vencedoras. Três rascunhos em 2K mais uma versão final em 4K custam US$ 0,642 (US$ 0,402 mais US$ 0,24), contra US$ 0,96 de quatro tentativas em 4K.
Mande trabalhos em volume pela Batch API. Custa a metade, mas os resultados chegam com atraso, e pelo que a documentação mostra, o Partner Node do ComfyUI não oferece essa opção. Trabalho em volume pertence a um script.
Trabalho
Padrão
Batch
100 imagens em 2K
US$ 13,40
US$ 6,70
100 imagens em 4K
US$ 24,00
US$ 12,00
500 imagens em 2K
US$ 67,00
US$ 33,50
Chamando a API fora do ComfyUI
Às vezes o nó é a ferramenta errada: jobs noturnos, milhares de imagens ou um app sem tela de canvas. O mesmo modelo está disponível pelo SDK google-genai do Google. Você precisa de um projeto em plano pago no Google AI Studio, porque este modelo não tem plano gratuito.
Uma chamada mínima em Python
from google import genai
from google.genai import types
client = genai.Client() # reads your AI Studio credential from the environment
response = client.models.generate_content(
model="gemini-3-pro-image-preview",
contents=["Overhead photo of a walnut desk with a ceramic mug, soft window light"],
config=types.GenerateContentConfig(
response_modalities=["TEXT", "IMAGE"],
image_config=types.ImageConfig(aspect_ratio="16:9", image_size="2K"),
),
)
for part in response.parts:
if part.inline_data is not None:
part.as_image().save("desk.png")
Dois detalhes pegam as pessoas desprevenidas. image_size recebe "1K", "2K" ou "4K" com o K em maiúsculo, e as imagens de referência entram em contents como itens extras ao lado do prompt. Envolva a chamada em uma nova tentativa com backoff e registre cada resposta, porque um prompt filtrado devolve texto em vez de imagem.
Use o ComfyUI para iterar de forma interativa e o SDK para volume. As duas formas chegam ao mesmo modelo, então um prompt que funciona no canvas vai funcionar no script.
Erros comuns e correções rápidas
Sintoma
Causa provável
Correção
O nó não aparece na busca
A versão do ComfyUI está desatualizada
Atualize o ComfyUI e reinicie o aplicativo
A execução falha logo de início
Sem login, ou saldo de créditos zerado
Confira Configurações, Usuário e Configurações, Créditos
Sem imagem, só texto
O prompt foi filtrado ou está vago demais
Reescreva como um briefing de foto neutro
O texto na imagem está errado
Strings longas ou idiomas misturados
Coloque as palavras exatas entre aspas e mantenha-as curtas
A conta veio maior que o previsto
4K ligado, muitas novas tentativas ou muitas referências
Faça o rascunho em 2K e limite as novas tentativas por job
Execuções entram em fila ou dão erro em volume
Limites de concorrência
Rode menos jobs simultâneos
Use o Nano Banana Pro no PicassoIA
O ComfyUI é o lugar certo quando o modelo é uma etapa de um grafo mais longo. Para uma imagem só, uma aba do navegador é mais rápida. O Nano Banana Pro no PicassoIA não precisa de nós, de créditos do Comfy nem de código, e a página do modelo indica que ele é gratuito para usar online.
Passo a passo
Abra a página do modelo Nano Banana Pro.
Escreva o prompt como um briefing de foto: sujeito, cenário, luz, lente.
Defina a resolução como 1K, 2K (o padrão) ou 4K.
Escolha uma proporção entre as 11 predefinições, incluindo 16:9, 9:16, 4:5 e 21:9.
Adicione até 14 imagens de referência se quiser um sujeito ou estilo específico.
Escolha JPG ou PNG. Deixe o filtro de segurança no padrão, block_only_high, a menos que sua plataforma exija uma configuração mais rígida.
Gere, revise o resultado e mude uma coisa por vez no prompt.
Alternativas que valem o teste
Nenhum modelo vence em todos os prompts. Estes estão na mesma coleção de texto para imagem, então um teste lado a lado custa alguns minutos.
Você quer outro modelo do Google para cenas limpas e realistas
O PicassoIA também oferece edição de imagens, remoção de fundo e super-resolução para upscaling de 2x a 4x, então uma renderização pode ser corrigida, recortada ou ampliada sem sair da plataforma.
Faça sua primeira imagem hoje
Agora você tem o quadro completo: atualize o ComfyUI, faça login, adicione créditos, rode o template e fique de olho na resolução. Um primeiro teste custa alguns centavos, e você aprende mais com uma execução real do que com qualquer quantidade de leitura.
Se preferir pular a configuração, abra o Nano Banana Pro no PicassoIA, cole um prompt deste artigo e clique em gerar. Teste o mesmo briefing em 2K e em 4K, depois compare os resultados com um segundo modelo da tabela acima. Picasso IA torna essa comparação rápida, então o próximo passo é simples: escreva um prompt, renderize e veja o que o Nano Banana Pro faz com ele.