Qwen Image 3.0: pesos abertos, API e configuração local
O Qwen Image 3.0 não tem pesos para download: ele funciona apenas pela API hospedada da Alibaba Cloud, a cerca de US$ 0,03 por imagem. Este artigo separa fato de boato, lista quais versões anteriores do Qwen Image são abertas, mostra uma configuração local com Diffusers e explica como testar o Qwen Image 3 no navegador.
Se você pesquisou pesos abertos do Qwen Image 3.0, a resposta direta é: eles não existem. A equipe Qwen da Alibaba anunciou o Qwen Image 3.0 em 21 de julho de 2026 como um serviço hospedado, e nenhum repositório no Hugging Face, cartão de modelo, arquivo de licença ou relatório técnico apareceu para ele. O que você pode fazer hoje se resume a três caminhos: chamar o modelo pela API da Alibaba Cloud, rodar uma versão aberta anterior do Qwen Image na sua própria GPU ou testar o Qwen Image 3 no navegador, na PicassoIA, sem instalar nada.
Esta página mostra qual caminho faz sentido para você, quanto cada um custa e como configurá-lo sem correr atrás de downloads que não existem. Todos os números abaixo vêm de páginas públicas publicadas entre agosto e setembro de 2026, e, quando as fontes divergem, eu digo isso.
A resposta curta sobre os pesos
Em 13 de agosto de 2026, uma verificação independente no Hugging Face e no ModelScope não encontrou nenhum repositório do Qwen Image 3.0 nas organizações Qwen ou Tongyi-MAI. A documentação revisada no fim de agosto ainda descrevia o modelo como acessível apenas por meio de hospedagem na Qwen e no acesso da Alibaba Cloud. Em termos simples, você não consegue baixar o Qwen Image 3.0 e não consegue rodá-lo na sua própria máquina.
O que a Alibaba realmente lançou
O Qwen Image 3.0 vem em duas versões: um modelo padrão (qwen-image-3.0) e um modelo Pro (qwen-image-3.0-pro). Um único modelo faz geração de imagens a partir de texto e edição de imagens. As especificações divulgadas são estas:
Tamanho do prompt: até cerca de 4,5K tokens por requisição
Resolução: até 2048×2048 pixels
Renderização de texto: caracteres de até cerca de 10 pixels, em 12 idiomas
Estilos: mais de 100 visuais prontos
Saída: várias imagens por requisição
O foco são visuais densos em informação, como infográficos, páginas de jornal, folhas de atividades, maquetes de interface e storyboards, e não apenas imagens bonitas.
O que "código aberto" significa aqui
As pessoas misturam três coisas diferentes quando digitam "código aberto" ao lado do nome de um modelo:
Pesos abertos: você pode baixar os arquivos do modelo e rodá-los por conta própria.
Licença aberta: os arquivos vêm com permissão para uso comercial.
Acesso aberto: qualquer pessoa pode pagar e chamar o modelo por uma API.
O Qwen Image 3.0 oferece apenas o terceiro. Isso importa na prática: você não pode fazer fine-tuning, não pode fixar uma versão no seu próprio servidor e, se a Alibaba mudar o preço ou desativar uma versão, seu pipeline muda junto.
💡 Cuidado com downloads falsos. Qualquer site, torrent ou canal de conversa que ofereça "pesos do Qwen Image 3.0" não é da Alibaba, porque a Alibaba não publicou nenhum. Arquivos assim são um meio comum de espalhar malware. Fique com as organizações oficiais da Qwen no Hugging Face e no ModelScope.
Quais versões do Qwen Image são abertas
A família Qwen Image não é fechada como um todo. Várias versões anteriores são abertas, e é daí que toda configuração local começa.
Versão
Pesos
Licença
Observações
Qwen Image (agosto de 2025)
Sim
Apache 2.0
MMDiT de 20B parâmetros, focado em texto
Qwen Image Edit 2511 (dezembro de 2025)
Sim
Apache 2.0
Variante de edição
Qwen Image 2512 (dezembro de 2025)
Sim
Apache 2.0
Texto mais nítido, rostos mais realistas
Qwen Image 2.0 (fevereiro de 2026)
Não no anúncio
n/a
Os pesos não tinham sido lançados quando a notícia do repositório foi publicada
Qwen Image 3.0 e 3.0 Pro (julho de 2026)
Não
Termos de serviço hospedados
Apenas API
Qwen Image 2.1 (setembro de 2026)
Sim
Licença de pesquisa
Gerador de 7B mais codificador de 8B
As versões Apache 2.0
Os pesos originais do Qwen Image foram publicados em 4 de agosto de 2025, no Hugging Face e no ModelScope, sob Apache 2.0. Essa licença permite uso comercial, modificação e redistribuição com poucas restrições. As versões de dezembro de 2025, Qwen Image Edit 2511 e Qwen Image 2512, seguiram o mesmo padrão, e o repositório no GitHub traz trechos prontos de Diffusers para cada uma.
Se o seu objetivo é um modelo que você possa fazer fine-tuning, hospedar no seu próprio servidor ou incluir em um produto sem uma cobrança por imagem, estes são os arquivos para olhar.
Qwen Image 2.1 e sua licença
Comparações publicadas descrevem o Qwen Image 2.1 como uma versão de pesos abertos, com um gerador visual de 7B, um codificador de visão e linguagem de 8B e saída transparente nativa. Uma comparação a situa em 20 de setembro de 2026. O problema está na licença. Relatos dizem que os materiais liberados usam uma licença de pesquisa, e o uso comercial exige um acordo separado com a Qwen.
💡 Leia a licença na página do modelo antes de gerar qualquer coisa para um cliente. "Os pesos podem ser baixados" e "a saída pode ser vendida" são duas perguntas separadas.
Como funciona a API hospedada
Se você quer o próprio Qwen Image 3.0, a API é o único caminho. Ela funciona pelo Alibaba Cloud Model Studio, também chamado de DashScope na documentação da API.
Acesso e nomes dos modelos
Duas regiões importam. A região de Singapura atende a maioria dos usuários fora da China continental, e uma região de Pequim atende o mercado chinês. Os tokens de API são específicos de cada região, então um token criado para uma delas não funciona na outra. Agregadores de terceiros também listam o modelo: o OpenRouter oferece o Qwen Image 3.0 desde o início de agosto de 2026, por cerca de US$ 0,03 por imagem de 1K.
O fluxo de configuração fica assim:
Crie uma conta na Alibaba Cloud e abra o Model Studio na região de Singapura.
Ative os modelos de geração de imagens que você pretende usar.
Crie um token de API no console e guarde-o em uma variável de ambiente.
Chame qwen-image-3.0 ou qwen-image-3.0-pro com um prompt e um tamanho.
Quanto custa por imagem
Preços divulgados para a região de Singapura em 31 de agosto de 2026:
Item
Preço
Qwen Image 3.0 padrão, por imagem gerada
US$ 0,03
Qwen Image 3.0 Pro, por imagem gerada
US$ 0,04 a US$ 0,075
Imagem de entrada para edição, por imagem
US$ 0,003
Cota gratuita
10 imagens, válidas por 90 dias
Com essas tarifas, 1.000 imagens padrão custam cerca de US$ 30, e 10.000 custam cerca de US$ 300. O Pro fica entre US$ 400 e US$ 750 para 10.000, dependendo do tamanho da saída. A edição acrescenta alguns décimos de centavo de dólar por imagem de referência. As tarifas nativas da Alibaba Cloud não estavam totalmente documentadas em todos os textos, então confira a página de cobrança antes de planejar um orçamento com base nesses números.
Um exemplo de requisição
Aqui está o formato geral de uma chamada de texto para imagem. Trate-o como ponto de partida, e não como receita para copiar e colar.
💡 Confirme os detalhes no seu próprio console. Os nomes dos campos seguem o padrão DashScope usado pelos modelos Qwen Image anteriores, mas artigos de terceiros divergem sobre o endereço exato do endpoint. Copie a URL e o esquema da requisição mostrados no Model Studio antes de colocar qualquer coisa em produção.
Os limites de requisição não estão documentados oficialmente. Quem integra relata respostas 429 sob carga, então implemente backoff exponencial desde o início, em vez de tentar de novo imediatamente.
Configuração local com os pesos abertos do Qwen
Como o Qwen Image 3.0 não pode rodar localmente, uma configuração local significa uma das versões abertas listadas acima. O Qwen Image 2512 é a escolha natural para trabalho geral, porque melhorou a nitidez do texto e o realismo dos rostos em relação ao original.
Choque de realidade do hardware
O modelo original tem 20B parâmetros. Em bfloat16, isso dá cerca de 40 GB só para o modelo de imagem, sem contar o codificador de texto. Aqui está uma tabela de planejamento aproximada:
Configuração
O que esperar
48 GB ou mais de memória de GPU
Roda em bfloat16 com folga
Placa de consumo de 24 GB
Precisa de offload para a CPU ou de uma versão quantizada, mais lenta por imagem
Placa de 12 a 16 GB
Possível só com quantização pesada, prepare-se para esperas longas
Sem GPU dedicada
Não é prático, use uma opção hospedada
Conversões FP8 e GGUF criadas pela comunidade são muito usadas no ComfyUI para encaixar o modelo em placas menores. A qualidade varia conforme a conversão, então teste os seus próprios prompts antes de se decidir por uma. Planeje também um armazenamento rápido: os arquivos do modelo chegam a dezenas de gigabytes, e o offload para a CPU depende da memória do sistema, então 32 GB de RAM é um piso confortável.
Instale e rode com o Diffusers
O repositório recomenda instalar o Diffusers a partir do código-fonte:
Se o Python reclamar de um pacote ausente para o codificador de texto quando o pipeline carregar, instale-o com pip e rode o script de novo. Depois, um script mínimo usando os pesos do 2512:
import torch
from diffusers import DiffusionPipeline
pipe = DiffusionPipeline.from_pretrained(
"Qwen/Qwen-Image-2512",
torch_dtype=torch.bfloat16,
)
pipe.enable_model_cpu_offload()
image = pipe(
prompt="A rainy street market at dusk, a hand-painted sign reading OPEN",
negative_prompt=" ",
width=1664,
height=928,
num_inference_steps=50,
true_cfg_scale=4.0,
generator=torch.Generator(device="cuda").manual_seed(42),
).images[0]
image.save("qwen-test.png")
Troque por Qwen/Qwen-Image para rodar a versão original, ou por Qwen/Qwen-Image-Edit-2511 com o pipeline de edição se quiser alterar fotos existentes. A primeira execução baixa dezenas de gigabytes, então comece com uma conexão estável e um disco com espaço sobrando.
Quando o local vence a API
A US$ 0,03 por imagem, a conta da API continua pequena para a maioria dos criadores. Hospedar por conta própria só começa a compensar quando você gera dezenas de milhares de imagens por mês com uma GPU que fica ocupada o tempo todo, ou quando regras de privacidade proíbem enviar prompts a terceiros. Uma placa parada custa mais do que a API jamais custaria.
O que o Qwen Image 3.0 faz melhor
A qualidade é o principal motivo para as pessoas quererem a versão 3.0, então vale a pena ver onde ela realmente se justifica.
Textos legíveis em imagens
Letras embaralhadas são a marca clássica de uma imagem de IA. Os modelos Qwen foram criados para evitar isso, e a versão 3.0 leva essa melhora até as letras pequenas: placas, rótulos, cardápios e legendas que continuam legíveis. Um prompt como "a chalkboard sign reading OPEN" deve gerar exatamente essa palavra, com a grafia correta.
Alguns hábitos deixam o texto mais limpo em qualquer modelo Qwen:
Coloque o texto exato entre aspas. Coloque o texto que você quer entre aspas duplas.
Mantenha curto. Uma a três palavras por placa ou rótulo são muito mais seguras do que um parágrafo.
Diga qual é a superfície. Giz sobre lousa, tinta sobre tijolo e tinta sobre papel são renderizados de formas diferentes.
Diga onde ele fica. "Acima da porta" ou "no quadro de cardápio à esquerda" tira as dúvidas.
Layouts densos e edição
Páginas de jornal, folhas de atividades, storyboards e dashboards são onde a capacidade de prompt longo, de 4,5K tokens, realmente compensa. Você pode descrever cada coluna, legenda e painel em uma única solicitação. O mesmo modelo aceita imagens de referência, então você pode mudar o estilo ou corrigir uma única área de uma foto sem redesenhar a cena inteira.
💡 Revise tudo. Revisores alertam que layouts gerados podem parecer confiáveis mesmo quando estão errados. Confira nomes, números e datas antes de publicar qualquer coisa.
Use o Qwen Image 3 na PicassoIA
Existe um quarto caminho que dispensa tokens, páginas de cobrança e placas de vídeo. O Qwen Image 3 roda diretamente na PicassoIA, e a página do modelo indica que ele é gratuito para usar online.
Escreva seu prompt em frases simples. Coloque entre aspas qualquer texto que deva aparecer na imagem e mantenha-o curto.
Escolha uma proporção. Use 16:9 para banners, 9:16 para stories e 1:1 para posts no feed.
Deixe a expansão de prompt ativada para prompts curtos, ou desative-a quando quiser controle total.
Clique em gerar e revise o resultado. Ajuste uma coisa de cada vez e gere de novo.
Fixe o seed quando gostar de um resultado, para poder recriá-lo depois.
Para editar, envie uma foto no campo de imagem, descreva a mudança e ative a opção que corresponde à resolução da entrada para que a saída mantenha o tamanho original.
Configurações que importam
Configuração
O que faz
Prompt
Texto obrigatório que descreve a imagem ou a edição
Proporção
Nove predefinições: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1 e 1:2
Prompt negativo
Indica o que deixar de fora, como marcas d’água ou dedos extras
Seed
Qualquer inteiro de 0 a 2147483647 para resultados repetíveis
Expansão de prompt
Ativada por padrão, reescreve prompts curtos em versões mais ricas
Igualar à imagem de entrada
Mantém o tamanho e as proporções de uma foto enviada
Precisa de cenas mais cheias? Experimente o Qwen Image 3 Pro, que lida com composições lotadas com vários objetos distintos. Se você prefere a linhagem de pesos abertos sem instalar nada localmente, o Qwen Image 2512 e o Qwen Image original estão disponíveis, e o Qwen Image Edit 2511 cuida das alterações em fotos. Para estilos personalizados, há também o Qwen Image LoRA Trainer Legacy.
Qual caminho é para você
Combine sua situação com a opção certa:
Sua situação
Melhor caminho
Você precisa da saída do Qwen Image 3.0 no seu próprio app
API da Alibaba Cloud
Você quer arquivos que possa fazer fine-tuning e hospedar
Pesos abertos, como o Qwen Image 2512
Você não tem GPU e quer resultados em minutos
PicassoIA no navegador
Você precisa de direitos comerciais sem burocracia extra
Versões Apache 2.0 ou os termos hospedados
Você gera menos de alguns milhares de imagens por mês
API ou PicassoIA, não hardware local
Três erros a evitar
Procurar um download. Não existem pesos oficiais do Qwen Image 3.0, e qualquer coisa com esse rótulo é suspeita.
Pular a licença. O Qwen Image 2.1 usa licença de pesquisa, enquanto as versões mais antigas usam Apache 2.0.
Calcular o orçamento com o preço padrão. A saída da versão Pro custa mais, até US$ 0,075 por imagem.
Experimente os Qwen Images na Picasso IA hoje
O resumo honesto é curto: o Qwen Image 3.0 fica atrás de uma API, os pesos abertos pertencem às versões mais antigas, e a forma mais rápida de ver o que a família faz é digitar um prompt e olhar o resultado. Abra o Qwen Image 3 na Picasso IA, escreva um prompt com uma placa ou rótulo curto dentro dele e compare a saída com o Qwen Image 2512. Rode o mesmo prompt nos dois, mude um detalhe e fique com a versão de que você mais gostar.
Veja a lista completa de modelos em picassoia.com/en/all-models para encontrar a opção certa para pôsteres, fotos de produto, maquetes e edições de foto, e comece sua primeira geração hoje.