Qwen Image 3.0: pesos abertos, API e configuração local

O Qwen Image 3.0 não tem pesos para download: ele funciona apenas pela API hospedada da Alibaba Cloud, a cerca de US$ 0,03 por imagem. Este artigo separa fato de boato, lista quais versões anteriores do Qwen Image são abertas, mostra uma configuração local com Diffusers e explica como testar o Qwen Image 3 no navegador.

Qwen Image 3.0: pesos abertos, API e configuração local
Cristian Da Conceicao
Fundador do Picasso IA

Se você pesquisou pesos abertos do Qwen Image 3.0, a resposta direta é: eles não existem. A equipe Qwen da Alibaba anunciou o Qwen Image 3.0 em 21 de julho de 2026 como um serviço hospedado, e nenhum repositório no Hugging Face, cartão de modelo, arquivo de licença ou relatório técnico apareceu para ele. O que você pode fazer hoje se resume a três caminhos: chamar o modelo pela API da Alibaba Cloud, rodar uma versão aberta anterior do Qwen Image na sua própria GPU ou testar o Qwen Image 3 no navegador, na PicassoIA, sem instalar nada.

Esta página mostra qual caminho faz sentido para você, quanto cada um custa e como configurá-lo sem correr atrás de downloads que não existem. Todos os números abaixo vêm de páginas públicas publicadas entre agosto e setembro de 2026, e, quando as fontes divergem, eu digo isso.

A resposta curta sobre os pesos

Em 13 de agosto de 2026, uma verificação independente no Hugging Face e no ModelScope não encontrou nenhum repositório do Qwen Image 3.0 nas organizações Qwen ou Tongyi-MAI. A documentação revisada no fim de agosto ainda descrevia o modelo como acessível apenas por meio de hospedagem na Qwen e no acesso da Alibaba Cloud. Em termos simples, você não consegue baixar o Qwen Image 3.0 e não consegue rodá-lo na sua própria máquina.

O que a Alibaba realmente lançou

O Qwen Image 3.0 vem em duas versões: um modelo padrão (qwen-image-3.0) e um modelo Pro (qwen-image-3.0-pro). Um único modelo faz geração de imagens a partir de texto e edição de imagens. As especificações divulgadas são estas:

  • Tamanho do prompt: até cerca de 4,5K tokens por requisição
  • Resolução: até 2048×2048 pixels
  • Renderização de texto: caracteres de até cerca de 10 pixels, em 12 idiomas
  • Estilos: mais de 100 visuais prontos
  • Saída: várias imagens por requisição

O foco são visuais densos em informação, como infográficos, páginas de jornal, folhas de atividades, maquetes de interface e storyboards, e não apenas imagens bonitas.

O que "código aberto" significa aqui

As pessoas misturam três coisas diferentes quando digitam "código aberto" ao lado do nome de um modelo:

  1. Pesos abertos: você pode baixar os arquivos do modelo e rodá-los por conta própria.
  2. Licença aberta: os arquivos vêm com permissão para uso comercial.
  3. Acesso aberto: qualquer pessoa pode pagar e chamar o modelo por uma API.

O Qwen Image 3.0 oferece apenas o terceiro. Isso importa na prática: você não pode fazer fine-tuning, não pode fixar uma versão no seu próprio servidor e, se a Alibaba mudar o preço ou desativar uma versão, seu pipeline muda junto.

💡 Cuidado com downloads falsos. Qualquer site, torrent ou canal de conversa que ofereça "pesos do Qwen Image 3.0" não é da Alibaba, porque a Alibaba não publicou nenhum. Arquivos assim são um meio comum de espalhar malware. Fique com as organizações oficiais da Qwen no Hugging Face e no ModelScope.

Um muro de pedra desgastado com um portão de madeira amplo aberto de um lado e um portão de ferro fechado com cadeado do outro

Quais versões do Qwen Image são abertas

A família Qwen Image não é fechada como um todo. Várias versões anteriores são abertas, e é daí que toda configuração local começa.

VersãoPesosLicençaObservações
Qwen Image (agosto de 2025)SimApache 2.0MMDiT de 20B parâmetros, focado em texto
Qwen Image Edit 2511 (dezembro de 2025)SimApache 2.0Variante de edição
Qwen Image 2512 (dezembro de 2025)SimApache 2.0Texto mais nítido, rostos mais realistas
Qwen Image 2.0 (fevereiro de 2026)Não no anúncion/aOs pesos não tinham sido lançados quando a notícia do repositório foi publicada
Qwen Image 3.0 e 3.0 Pro (julho de 2026)NãoTermos de serviço hospedadosApenas API
Qwen Image 2.1 (setembro de 2026)SimLicença de pesquisaGerador de 7B mais codificador de 8B

As versões Apache 2.0

Os pesos originais do Qwen Image foram publicados em 4 de agosto de 2025, no Hugging Face e no ModelScope, sob Apache 2.0. Essa licença permite uso comercial, modificação e redistribuição com poucas restrições. As versões de dezembro de 2025, Qwen Image Edit 2511 e Qwen Image 2512, seguiram o mesmo padrão, e o repositório no GitHub traz trechos prontos de Diffusers para cada uma.

Se o seu objetivo é um modelo que você possa fazer fine-tuning, hospedar no seu próprio servidor ou incluir em um produto sem uma cobrança por imagem, estes são os arquivos para olhar.

Qwen Image 2.1 e sua licença

Comparações publicadas descrevem o Qwen Image 2.1 como uma versão de pesos abertos, com um gerador visual de 7B, um codificador de visão e linguagem de 8B e saída transparente nativa. Uma comparação a situa em 20 de setembro de 2026. O problema está na licença. Relatos dizem que os materiais liberados usam uma licença de pesquisa, e o uso comercial exige um acordo separado com a Qwen.

💡 Leia a licença na página do modelo antes de gerar qualquer coisa para um cliente. "Os pesos podem ser baixados" e "a saída pode ser vendida" são duas perguntas separadas.

Como funciona a API hospedada

Se você quer o próprio Qwen Image 3.0, a API é o único caminho. Ela funciona pelo Alibaba Cloud Model Studio, também chamado de DashScope na documentação da API.

Vista de baixo para cima de um corredor de racks de servidores pretos em um data center silencioso

Acesso e nomes dos modelos

Duas regiões importam. A região de Singapura atende a maioria dos usuários fora da China continental, e uma região de Pequim atende o mercado chinês. Os tokens de API são específicos de cada região, então um token criado para uma delas não funciona na outra. Agregadores de terceiros também listam o modelo: o OpenRouter oferece o Qwen Image 3.0 desde o início de agosto de 2026, por cerca de US$ 0,03 por imagem de 1K.

O fluxo de configuração fica assim:

  1. Crie uma conta na Alibaba Cloud e abra o Model Studio na região de Singapura.
  2. Ative os modelos de geração de imagens que você pretende usar.
  3. Crie um token de API no console e guarde-o em uma variável de ambiente.
  4. Chame qwen-image-3.0 ou qwen-image-3.0-pro com um prompt e um tamanho.

Mesa de um desenvolvedor vista de cima com um notebook, um cartão de token de acesso escrito à mão e uma xícara de café

Quanto custa por imagem

Preços divulgados para a região de Singapura em 31 de agosto de 2026:

ItemPreço
Qwen Image 3.0 padrão, por imagem geradaUS$ 0,03
Qwen Image 3.0 Pro, por imagem geradaUS$ 0,04 a US$ 0,075
Imagem de entrada para edição, por imagemUS$ 0,003
Cota gratuita10 imagens, válidas por 90 dias

Com essas tarifas, 1.000 imagens padrão custam cerca de US$ 30, e 10.000 custam cerca de US$ 300. O Pro fica entre US$ 400 e US$ 750 para 10.000, dependendo do tamanho da saída. A edição acrescenta alguns décimos de centavo de dólar por imagem de referência. As tarifas nativas da Alibaba Cloud não estavam totalmente documentadas em todos os textos, então confira a página de cobrança antes de planejar um orçamento com base nesses números.

Vista superior com uma calculadora de latão, recibos de papel e um caderno com colunas desenhadas à mão

Um exemplo de requisição

Aqui está o formato geral de uma chamada de texto para imagem. Trate-o como ponto de partida, e não como receita para copiar e colar.

curl -X POST "$DASHSCOPE_ENDPOINT" \
  -H "Authorization: Bearer $DASHSCOPE_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen-image-3.0",
    "input": {
      "messages": [
        {
          "role": "user",
          "content": [
            { "text": "A chalkboard sign reading OPEN outside a corner cafe, morning light" }
          ]
        }
      ]
    },
    "parameters": { "size": "2048*1152", "n": 1 }
  }'

💡 Confirme os detalhes no seu próprio console. Os nomes dos campos seguem o padrão DashScope usado pelos modelos Qwen Image anteriores, mas artigos de terceiros divergem sobre o endereço exato do endpoint. Copie a URL e o esquema da requisição mostrados no Model Studio antes de colocar qualquer coisa em produção.

Vista por cima do ombro de uma mulher digitando em um notebook em um espaço de coworking iluminado

Os limites de requisição não estão documentados oficialmente. Quem integra relata respostas 429 sob carga, então implemente backoff exponencial desde o início, em vez de tentar de novo imediatamente.

Configuração local com os pesos abertos do Qwen

Como o Qwen Image 3.0 não pode rodar localmente, uma configuração local significa uma das versões abertas listadas acima. O Qwen Image 2512 é a escolha natural para trabalho geral, porque melhorou a nitidez do texto e o realismo dos rostos em relação ao original.

Choque de realidade do hardware

O modelo original tem 20B parâmetros. Em bfloat16, isso dá cerca de 40 GB só para o modelo de imagem, sem contar o codificador de texto. Aqui está uma tabela de planejamento aproximada:

ConfiguraçãoO que esperar
48 GB ou mais de memória de GPURoda em bfloat16 com folga
Placa de consumo de 24 GBPrecisa de offload para a CPU ou de uma versão quantizada, mais lenta por imagem
Placa de 12 a 16 GBPossível só com quantização pesada, prepare-se para esperas longas
Sem GPU dedicadaNão é prático, use uma opção hospedada

Conversões FP8 e GGUF criadas pela comunidade são muito usadas no ComfyUI para encaixar o modelo em placas menores. A qualidade varia conforme a conversão, então teste os seus próprios prompts antes de se decidir por uma. Planeje também um armazenamento rápido: os arquivos do modelo chegam a dezenas de gigabytes, e o offload para a CPU depende da memória do sistema, então 32 GB de RAM é um piso confortável.

Foto macro de mãos encaixando uma placa de vídeo grande em um slot da placa-mãe

Instale e rode com o Diffusers

O repositório recomenda instalar o Diffusers a partir do código-fonte:

pip install git+https://github.com/huggingface/diffusers
pip install torch accelerate

Se o Python reclamar de um pacote ausente para o codificador de texto quando o pipeline carregar, instale-o com pip e rode o script de novo. Depois, um script mínimo usando os pesos do 2512:

import torch
from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained(
    "Qwen/Qwen-Image-2512",
    torch_dtype=torch.bfloat16,
)
pipe.enable_model_cpu_offload()

image = pipe(
    prompt="A rainy street market at dusk, a hand-painted sign reading OPEN",
    negative_prompt=" ",
    width=1664,
    height=928,
    num_inference_steps=50,
    true_cfg_scale=4.0,
    generator=torch.Generator(device="cuda").manual_seed(42),
).images[0]

image.save("qwen-test.png")

Troque por Qwen/Qwen-Image para rodar a versão original, ou por Qwen/Qwen-Image-Edit-2511 com o pipeline de edição se quiser alterar fotos existentes. A primeira execução baixa dezenas de gigabytes, então comece com uma conexão estável e um disco com espaço sobrando.

Quando o local vence a API

A US$ 0,03 por imagem, a conta da API continua pequena para a maioria dos criadores. Hospedar por conta própria só começa a compensar quando você gera dezenas de milhares de imagens por mês com uma GPU que fica ocupada o tempo todo, ou quando regras de privacidade proíbem enviar prompts a terceiros. Uma placa parada custa mais do que a API jamais custaria.

Foto macro de três ventoinhas pretas de GPU e uma pilha densa de aletas de alumínio em uma sala escura

O que o Qwen Image 3.0 faz melhor

A qualidade é o principal motivo para as pessoas quererem a versão 3.0, então vale a pena ver onde ela realmente se justifica.

Textos legíveis em imagens

Letras embaralhadas são a marca clássica de uma imagem de IA. Os modelos Qwen foram criados para evitar isso, e a versão 3.0 leva essa melhora até as letras pequenas: placas, rótulos, cardápios e legendas que continuam legíveis. Um prompt como "a chalkboard sign reading OPEN" deve gerar exatamente essa palavra, com a grafia correta.

Alguns hábitos deixam o texto mais limpo em qualquer modelo Qwen:

  • Coloque o texto exato entre aspas. Coloque o texto que você quer entre aspas duplas.
  • Mantenha curto. Uma a três palavras por placa ou rótulo são muito mais seguras do que um parágrafo.
  • Diga qual é a superfície. Giz sobre lousa, tinta sobre tijolo e tinta sobre papel são renderizados de formas diferentes.
  • Diga onde ele fica. "Acima da porta" ou "no quadro de cardápio à esquerda" tira as dúvidas.

Fachada de cafeteria em uma rua de paralelepípedos com uma placa de giz com a palavra OPEN

Layouts densos e edição

Páginas de jornal, folhas de atividades, storyboards e dashboards são onde a capacidade de prompt longo, de 4,5K tokens, realmente compensa. Você pode descrever cada coluna, legenda e painel em uma única solicitação. O mesmo modelo aceita imagens de referência, então você pode mudar o estilo ou corrigir uma única área de uma foto sem redesenhar a cena inteira.

💡 Revise tudo. Revisores alertam que layouts gerados podem parecer confiáveis mesmo quando estão errados. Confira nomes, números e datas antes de publicar qualquer coisa.

Use o Qwen Image 3 na PicassoIA

Existe um quarto caminho que dispensa tokens, páginas de cobrança e placas de vídeo. O Qwen Image 3 roda diretamente na PicassoIA, e a página do modelo indica que ele é gratuito para usar online.

Passo a passo

  1. Abra a página do modelo Qwen Image 3.
  2. Escreva seu prompt em frases simples. Coloque entre aspas qualquer texto que deva aparecer na imagem e mantenha-o curto.
  3. Escolha uma proporção. Use 16:9 para banners, 9:16 para stories e 1:1 para posts no feed.
  4. Deixe a expansão de prompt ativada para prompts curtos, ou desative-a quando quiser controle total.
  5. Clique em gerar e revise o resultado. Ajuste uma coisa de cada vez e gere de novo.
  6. Fixe o seed quando gostar de um resultado, para poder recriá-lo depois.

Para editar, envie uma foto no campo de imagem, descreva a mudança e ative a opção que corresponde à resolução da entrada para que a saída mantenha o tamanho original.

Configurações que importam

ConfiguraçãoO que faz
PromptTexto obrigatório que descreve a imagem ou a edição
ProporçãoNove predefinições: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1 e 1:2
Prompt negativoIndica o que deixar de fora, como marcas d’água ou dedos extras
SeedQualquer inteiro de 0 a 2147483647 para resultados repetíveis
Expansão de promptAtivada por padrão, reescreve prompts curtos em versões mais ricas
Igualar à imagem de entradaMantém o tamanho e as proporções de uma foto enviada

Precisa de cenas mais cheias? Experimente o Qwen Image 3 Pro, que lida com composições lotadas com vários objetos distintos. Se você prefere a linhagem de pesos abertos sem instalar nada localmente, o Qwen Image 2512 e o Qwen Image original estão disponíveis, e o Qwen Image Edit 2511 cuida das alterações em fotos. Para estilos personalizados, há também o Qwen Image LoRA Trainer Legacy.

Qual caminho é para você

Combine sua situação com a opção certa:

Sua situaçãoMelhor caminho
Você precisa da saída do Qwen Image 3.0 no seu próprio appAPI da Alibaba Cloud
Você quer arquivos que possa fazer fine-tuning e hospedarPesos abertos, como o Qwen Image 2512
Você não tem GPU e quer resultados em minutosPicassoIA no navegador
Você precisa de direitos comerciais sem burocracia extraVersões Apache 2.0 ou os termos hospedados
Você gera menos de alguns milhares de imagens por mêsAPI ou PicassoIA, não hardware local

Três erros a evitar

  • Procurar um download. Não existem pesos oficiais do Qwen Image 3.0, e qualquer coisa com esse rótulo é suspeita.
  • Pular a licença. O Qwen Image 2.1 usa licença de pesquisa, enquanto as versões mais antigas usam Apache 2.0.
  • Calcular o orçamento com o preço padrão. A saída da versão Pro custa mais, até US$ 0,075 por imagem.

Experimente os Qwen Images na Picasso IA hoje

O resumo honesto é curto: o Qwen Image 3.0 fica atrás de uma API, os pesos abertos pertencem às versões mais antigas, e a forma mais rápida de ver o que a família faz é digitar um prompt e olhar o resultado. Abra o Qwen Image 3 na Picasso IA, escreva um prompt com uma placa ou rótulo curto dentro dele e compare a saída com o Qwen Image 2512. Rode o mesmo prompt nos dois, mude um detalhe e fique com a versão de que você mais gostar.

Uma criativa sorridente em um estúdio ensolarado segurando uma fotografia recém-impressa diante de uma parede de impressões

Veja a lista completa de modelos em picassoia.com/en/all-models para encontrar a opção certa para pôsteres, fotos de produto, maquetes e edições de foto, e comece sua primeira geração hoje.

Compartilhe este artigo

Escolha seu idioma