Limites do plano gratuito da API Gemini: modelos, limites de taxa e geração de imagens
O plano gratuito da API Gemini ainda funciona para modelos de texto, mas a geração de imagens e o vídeo Veo agora exigem faturamento. Este artigo detalha os limites de taxa por projeto, quais modelos continuam gratuitos, o que cada plano pago exige e onde criar imagens com IA sem uma conta no Google Cloud.
O plano gratuito da API Gemini ainda existe, mas não é mais como o que as pessoas descreviam há um ano. Modelos de texto podem ser chamados sem cartão de crédito, enquanto todo modelo que desenha imagens ou renderiza vídeo agora fica atrás do faturamento, e as cotas diárias dos modelos restantes mudaram mais de uma vez. Se você está planejando um projeto paralelo, um protótipo ou uma demonstração em sala de aula com base nesses limites, os detalhes decidem se seu app funciona no dia do lançamento ou começa a dar erro até a hora do almoço.
Este artigo explica o que o plano gratuito inclui, quais modelos você pode chamar sem faturamento, como os limites de taxa se comportam em um projeto real e por que a geração de imagens é o ponto de maior atrito. Você também verá o que os planos pagos exigem e onde criar imagens com IA sem uma conta no Google Cloud.
💡 Resposta rápida: Modelos de texto como o Gemini 2.5 Flash têm acesso gratuito com cotas por projeto apertadas. Modelos de imagem como o Nano Banana e o Imagen 4, além do vídeo Veo 3.1, precisam de um projeto com faturamento.
O que o plano gratuito inclui
Todo novo projeto da API Gemini começa no plano gratuito. O único requisito é ter um projeto ativo, então não há conta de faturamento para vincular nem cartão para cadastrar. Isso faz dele a forma mais rápida de testar um prompt, montar um protótipo ou verificar como um modelo lida com seus próprios dados.
Os limites se aplicam por projeto
O Google mede o uso por projeto, não por credencial da API. Criar cinco credenciais dentro de um mesmo projeto não dá cinco cotas, porque todas usam o mesmo conjunto. Dividir um app entre vários projetos para somar cotas é frágil e vale evitar isso. Planeje em torno da cota de um único projeto e desenhe seu app para caber nela.
RPM, TPM e RPD explicados
Quatro contadores decidem se uma requisição passa:
RPM conta requisições por minuto.
TPM conta tokens de entrada por minuto.
RPD conta requisições por dia e é zerado à meia-noite, horário do Pacífico.
IPM conta imagens por minuto e se aplica aos modelos de imagem.
Ultrapassar qualquer um desses contadores aciona um erro de limite de taxa, mesmo que os outros três estejam saudáveis. Um chatbot que envia mensagens curtas costuma esbarrar primeiro no RPM. Um resumidor de documentos que envia arquivos longos esbarra no TPM. Um app de hobby que roda a tarde inteira esbarra no RPD.
Limite
O que conta
Quem esbarra primeiro
RPM
Requisições em uma janela de 60 segundos
Apps de chat, scripts com picos de uso
TPM
Tokens de entrada em uma janela de 60 segundos
Documentos longos, contextos grandes
RPD
Requisições desde a última redefinição
Trabalhos em lote, ferramentas usadas o dia todo
IPM
Imagens por minuto
Laços de geração de imagens
Por que os números não param de mudar
A documentação do Google não traz mais uma tabela de plano gratuito por modelo. Os valores exatos de RPM, TPM e RPD do seu projeto aparecem na visualização de limites de taxa dentro do Google AI Studio, e podem ser diferentes de um projeto para outro. Em dezembro de 2025, desenvolvedores relataram cortes acentuados, com o Gemini 2.5 Flash caindo para cerca de 20 requisições por dia em alguns relatos. Tabelas de terceiros do início de 2026 listaram faixas de 5 a 15 RPM, cerca de 250.000 TPM e 100 a 1.000 RPD. Trate esses números como dados relatados, não como promessas.
💡 Dica: Leia os limites no seu próprio painel do AI Studio e nas mensagens de erro que seu app recebe. Fixar no código um número tirado de um blog, inclusive deste artigo, é o que faz os apps quebrarem depois de uma mudança silenciosa na cota.
Quais modelos funcionam sem faturamento
Nem todo modelo tem o mesmo status gratuito. No momento da redação, a página de preços separa com clareza os modelos de texto de tudo o que produz mídia.
Modelos de texto que você pode chamar de graça
A família Flash é o lar do plano gratuito. Segundo a página de preços, os modelos Gemini 3.x Flash e o Gemini 2.5 Flash aparecem como "gratuitos" na entrada e na saída no plano Standard. As variantes mais leves, Flash-Lite, vão além e continuam gratuitas nos planos Standard, Batch e Flex. Os modelos de texto para fala da classe Flash também são gratuitos nos planos Standard e Priority.
O Gemini 3.5 Flash é o modelo com que a maioria dos iniciantes deve começar, já que lida com chat, código e entradas de imagem em uma velocidade adequada a cotas tão pequenas. Batch e Flex não são gratuitos nos modelos Flash maiores, então um trabalho em massa nesses planos exige faturamento.
Modelos bloqueados atrás do faturamento
Tudo o que gera imagens, música ou vídeo precisa de um projeto pago. Os modelos de texto da classe Pro são a zona cinzenta, então confirme-os no AI Studio antes de construir sobre eles.
Uma equipe que escolhe um modelo deve fazer primeiro uma pergunta: o recurso precisa gerar mídia? Se sim, o plano gratuito já está descartado, e a decisão real é pagar diretamente ao Google ou usar outro caminho.
Limites de taxa em projetos reais
Um limite no papel e um limite em produção são coisas bem diferentes. No papel, 15 requisições por minuto parecem suficientes. Em produção, uma página que dispara quatro chamadas a cada carregamento vai bater nesse teto com meia dúzia de visitantes.
Um exercício rápido de dimensionamento ajuda. Divida seu limite diário de requisições pelo número de chamadas que uma ação do usuário faz. Suponha que seu projeto permita 100 requisições por dia e que cada ação faça três chamadas: você consegue atender cerca de 33 ações antes da redefinição, o que dá no máximo algumas dezenas de visitantes. Faça essa conta com os números do seu próprio painel do AI Studio antes de prometer qualquer coisa aos usuários.
Como ler um erro 429
Quando uma cota é estourada, a API responde com HTTP 429. A mensagem informa qual limite falhou, então leia antes de adivinhar.
O que você vê
Causa provável
Solução
Erros em rajadas curtas, depois recuperação
RPM
Enfileire as requisições e espace-as
Erros só em prompts longos
TPM
Reduza o contexto ou divida os documentos
Tudo certo de manhã, falhas à noite
RPD
Guarde resultados em cache e reduza o volume de chamadas
Modelo de imagem retorna cota zero
Sem plano gratuito
Vincule o faturamento ou use outra plataforma
Lógica de nova tentativa que funciona
O backoff exponencial com um pouco de aleatoriedade lida bem com os limites por minuto. Este padrão cabe em uma dúzia de linhas:
import random, time
def call_with_backoff(send, max_tries=5):
for attempt in range(max_tries):
try:
return send()
except RateLimitError:
wait = (2 ** attempt) + random.random()
time.sleep(wait)
raise RuntimeError("Rate limited after all retries")
O backoff resolve o RPM. Ele não resolve o RPD, porque essa cota só volta à meia-noite, horário do Pacífico, não importa quantas vezes você tente de novo com educação.
Quatro hábitos fazem uma cota gratuita pequena render mais:
Armazene em cache respostas repetidas, para que perguntas idênticas custem uma requisição só.
Reduza os prompts, já que menos tokens de entrada protegem seu TPM.
Agrupe perguntas relacionadas em uma única requisição quando a tarefa permitir.
Direcione tarefas simples para um modelo Flash-Lite e reserve o modelo maior para as difíceis.
A geração de imagens exige faturamento
É aqui que começa a confusão, porque conselhos antigos ainda aparecem nos resultados de busca.
Situação do Nano Banana e do Imagen
No início de 2026, vários posts relataram que o Gemini 2.5 Flash Image permitia até 500 imagens gratuitas por dia, em 1024 por 1024. Essa afirmação está desatualizada. A página de preços atual não lista plano gratuito para nenhum modelo de geração de imagens:
O Nano Banana 2, chamado Gemini 3.1 Flash Image na API, não tem plano gratuito.
O Nano Banana Pro, chamado Gemini 3 Pro Image na API, não tem plano gratuito.
A família Imagen 4 funciona apenas com uma conta de faturamento vinculada.
Depois há a cota fantasma. No AI Studio, um projeto gratuito pode mostrar um contador como "0 / 25" ao lado do Imagen, o que parece uma franquia diária. Uma discussão no fórum de desenvolvedores do Google, de fevereiro de 2026, relata que as requisições continuam falhando com uma mensagem dizendo que a API do Imagen só é acessível a usuários com faturamento. Ativar o faturamento também não acrescenta uma franquia diária gratuita. O único uso gratuito vem dos US$ 300 de crédito introdutório dados a novos usuários do Google Cloud, válidos por 90 dias. Depois que ele expira, as tarifas de pagamento por uso se aplicam imediatamente.
💡 Atenção: Um número de cota na tela não é uma promessa de acesso. Se um modelo está na coluna "Não" da página de preços, nenhuma quantidade de espera vai fazê-lo funcionar no plano gratuito.
Veo e limites de vídeo
O vídeo segue a mesma regra. O Veo 3.1 aparece como "não disponível" no plano gratuito em todas as suas variantes de preço padrão, então uma demonstração que renderiza clipes precisa de um projeto pago desde o primeiro dia. Se você quer clipes de vídeo sem nenhuma configuração de API, a PicassoIA hospeda o Veo 3.1, o Veo 3.1 Fast e o Veo 3.1 Lite para uso direto.
Subindo de nível nos planos
Os planos pagos elevam o teto e liberam os modelos de mídia. A mudança acontece automaticamente quando você atende às condições abaixo.
O que cada plano exige
Plano
Como você se qualifica
Limite de gastos
Free
Projeto ativo ou teste gratuito
Não se aplica
Tier 1
Conta de faturamento vinculada
US$ 250
Tier 2
US$ 100+ gastos e 3+ dias desde o primeiro pagamento
US$ 2.000
Tier 3
US$ 1.000+ gastos e 30+ dias desde o primeiro pagamento
US$ 20.000 a US$ 100.000+
Cada plano também tem um limite de gastos medido em uma janela móvel de 10 minutos: US$ 10 no Tier 1, US$ 50 no Tier 2 e US$ 200 no Tier 3. A mudança do plano gratuito para o Tier 1 passa a valer na hora após a configuração do faturamento. Upgrades posteriores chegam em até cerca de 10 minutos depois de você atender aos critérios.
Fique no plano gratuito se:
Você está prototipando apenas com texto.
Seu tráfego é de algumas centenas de requisições por dia ou menos.
Uma chamada que falha não custa nada para seus usuários.
Passe para o Tier 1 se:
Você precisa de saídas do Nano Banana, do Imagen ou do Veo.
Os limites diários quebram seu app antes do dia acabar.
Clientes reais dependem da resposta.
Geração de imagens gratuita sem faturamento
Se seu objetivo são imagens e não texto, existe um caminho mais curto do que um projeto no Google Cloud. A PicassoIA hospeda os modelos de imagem e vídeo do Google no navegador, então não há conta de faturamento do Google Cloud, configuração de projeto nem painel de cotas para acompanhar.
Modelos Gemini na PicassoIA
A linha de modelos do Google que exige faturamento pela API está disponível diretamente na plataforma:
Como são modelos separados, você pode enviar o mesmo prompt para dois deles e comparar os resultados. O Imagen 4 serve bem para imagens fotorrealistas, enquanto o Nano Banana 2 é a melhor escolha quando você quer editar ou fundir imagens existentes. Escolher pela tarefa, e não pelo nome, mantém seus resultados coerentes.
Como usar o Nano Banana 2
O Nano Banana 2 é o modelo para testar primeiro, porque cria imagens a partir de texto e também edita ou funde imagens existentes.
Escreva um prompt que informe o assunto, o cenário, a iluminação e a lente.
Adicione uma imagem de referência se quiser editar uma foto ou misturar duas imagens.
Escolha a proporção que combina com seu layout, como 16:9 para o cabeçalho de um blog.
Gere, revise o resultado e ajuste um detalhe do prompt de cada vez.
Prompts específicos funcionam melhor. Um pedido vago como "uma mesa" gera um resultado genérico, enquanto "uma mesa de carvalho de um desenvolvedor na hora dourada, vapor saindo de uma caneca, lente de 35mm, profundidade de campo rasa" entrega algo que você pode publicar.
💡 Dica: Mude apenas uma coisa por tentativa. Se a iluminação estiver errada, edite só as palavras de iluminação e deixe o resto como está. Assim você verá exatamente o que cada expressão faz.
Respostas rápidas
A API Gemini é gratuita?
Em parte. Os modelos de texto das famílias Flash e Flash-Lite têm plano gratuito com limites por projeto. Os modelos de texto da classe Pro, todos os modelos de imagem e o vídeo Veo exigem um projeto com faturamento.
O plano gratuito consegue gerar imagens?
Não. A página de preços atual não lista plano gratuito para o Nano Banana, para os modelos de imagem do Gemini nem para o Imagen. Posts que falam em centenas de imagens diárias gratuitas descrevem uma configuração antiga. Para criar imagens sem um projeto no Google Cloud, use uma plataforma como a PicassoIA com o Nano Banana 2 ou o Imagen 4.
Os limites são redefinidos todo dia?
As requisições por dia são redefinidas à meia-noite, horário do Pacífico. Os limites por minuto se recuperam conforme a janela móvel avança, e é por isso que o backoff resolve rajadas, mas não uma cota diária esgotada.
Crie suas próprias imagens hoje
O plano gratuito é um bom lugar para testar prompts de texto, mas no momento em que você precisa de uma imagem, uma conta de faturamento vira o preço de entrada do lado do Google. Você pode pular essa etapa. Abra o Nano Banana 2 na PicassoIA, digite a cena que tem em mente e veja o resultado em segundos. Experimente o Imagen 4 quando quiser uma imagem fotorrealista, ou o Veo 3.1 Fast quando uma imagem fixa não for suficiente. Rode o mesmo prompt em dois modelos, compare os resultados lado a lado e fique com o que combina com seu projeto. Todos os modelos estão listados em picassoia.com/en/all-models, para você comparar as opções antes de escolher uma.