Hunyuan3D de imagem para 3D: modelo gratuito, ComfyUI e API
O Hunyuan3D cria uma malha 3D texturizada a partir de uma única foto. Este artigo compara os pesos abertos gratuitos, o fluxo de trabalho no ComfyUI e a API hospedada, com números de VRAM, limites de licença, preços por geração e o preparo da foto que decide se sua malha sai limpa ou irregular.
Uma foto de produto entra, uma malha 3D texturizada sai. Essa é a promessa por trás do Hunyuan3D de imagem para 3D, a família de modelos da Tencent que transforma uma única imagem em geometria que você pode girar no Blender, levar para um motor de jogos ou enviar para uma impressora. A parte confusa é o acesso. Algumas versões são pesos abertos gratuitos que rodam na sua própria GPU, outras funcionam por nós do ComfyUI e as faixas mais novas ficam atrás de uma API com preço por geração. Este artigo organiza essas três rotas com números reais de memória, limites de licença e faixas de custo, para você escolher a que cabe no seu hardware e no seu orçamento antes de gastar uma tarde com a configuração.
Um aviso rápido sobre o momento: as linhas de modelos e os preços nesse setor mudam a cada poucos meses. Os números abaixo foram verificados em outubro de 2026, então trate-os como um retrato do momento e confirme na página do provedor antes de comprometer um orçamento.
O que o Hunyuan3D faz com uma foto
A conversão de imagem para 3D parece mágica até você ver o que acontece por trás. O modelo analisa sua foto, infere a forma das partes que não consegue ver e grava um arquivo de malha. É um excelente palpite, mas continua sendo um palpite, e esse fato explica boa parte dos bons e maus resultados que você vai ver adiante.
Primeiro a forma, depois a textura
O Hunyuan3D funciona em duas etapas. Um modelo de forma lê a foto e constrói a geometria, uma malha cinza sem cor. Um modelo de pintura então sintetiza a textura sobre essa geometria. Na versão 2.1, são duas redes separadas: Hunyuan3D-Shape-v2-1, com 3,3 bilhões de parâmetros, e Hunyuan3D-Paint-v2-1, com 2 bilhões.
A divisão importa na prática. Você pode rodar só a etapa de forma, que exige bem menos memória, e pular a texturização quando precisar apenas de um esboço volumétrico ou de uma impressão. A etapa de pintura na 2.1 produz materiais PBR, ou seja, mapas separados para indicar o quanto cada superfície é metálica, rugosa ou reflexiva. É isso que permite que uma maçaneta de latão continue parecendo latão quando a luz se move ao redor dela em um motor de jogo, em vez de parecer uma foto chapada colada sobre uma forma.
Qual versão é realmente gratuita
"Gratuito" aqui significa os pesos, não o processamento. A linha 2.x (2.0, a variante Mini e a 2.1) é aberta, então você pode baixá-la e rodá-la localmente ou dentro do ComfyUI sem taxa por geração. A linha 3.x é outra história.
Linha de versão
Como você acessa
O que custa
Melhor para
2.x (2.0, Mini, 2.1)
Pesos abertos, instalação local ou nós personalizados do ComfyUI
Seu próprio tempo de GPU e energia elétrica
Lotes, privacidade, experimentos
3.0
Hospedado, nós parceiros do ComfyUI e API
Créditos por geração
Entrada com várias vistas, partes, ferramentas de UV e topologia
3.1 Rapid
Somente API hospedada
Por geração
Prévias rápidas e iterações ágeis
3.1 Pro
Somente API hospedada
Preço mais alto por geração
Ativos com qualidade final
💡 Regra prática: se você gera dezenas de malhas por dia e tem uma GPU decente, comece com os pesos abertos da 2.x. Se você precisa de cinco boas malhas por mês e não tem GPU, as faixas hospedadas custam menos que uma placa de vídeo nova.
O modelo gratuito e suas exigências de hardware
Pesos abertos só são gratuitos se a sua máquina aguentar rodá-los. É aqui que a maioria das primeiras tentativas trava, então confira os números antes de baixar qualquer coisa.
Números de memória da GPU
O repositório do Hunyuan3D 2.1 lista três valores de memória:
10 GB de VRAM apenas para a geração de forma
21 GB de VRAM apenas para a geração de textura
29 GB de VRAM para o pipeline completo de forma mais textura
Leia esses números ao pé da letra. Uma placa de 12 GB consegue construir a malha cinza. Uma placa de 24 GB comporta qualquer uma das etapas sozinha, mas não as duas carregadas ao mesmo tempo. Para rodar tudo em uma única passagem, você precisa de uma placa da classe de 32 GB, ou de um fluxo de trabalho que descarregue o modelo de forma antes que o modelo de pintura comece.
Passos de instalação, em termos simples
A configuração oficial é voltada para quem se sente à vontade com o terminal. Em resumo:
Crie um ambiente Python 3.10.
Instale o PyTorch 2.5.1 compilado para CUDA 12.4.
Execute pip install -r requirements.txt a partir da pasta do repositório.
Compile os dois módulos personalizados, o rasterizador e o pintor de malha, seguindo as instruções do repositório. No Windows, essa etapa exige antes um conjunto de ferramentas de compilação C++ instalado.
Inicie o aplicativo Gradio incluído com python gradio_app.py e abra o endereço local que ele mostrar.
Se você quiser testar o modelo antes de mexer em nada disso, há uma demonstração pública no Hugging Face Spaces e uma interface web oficial da Tencent. As duas servem bem para uma checagem rápida de se o tipo da sua foto funciona.
Limites de licença a verificar
Os pesos abertos seguem o Tencent Hunyuan 3D 2.1 Community License Agreement. O território definido pela licença é o mundo excluindo a União Europeia, o Reino Unido e a Coreia do Sul. Se você mora em uma dessas regiões, ou entrega um produto para usuários de lá, os pesos abertos não estão licenciados para você, e o melhor é ler os termos de um provedor hospedado.
💡 Antes do uso comercial: leia você mesmo o texto completo da licença. As malhas que você gerar podem ter condições, e "aberto" não significa "faça o que quiser".
O preparo da foto decide o resultado
Dê ao modelo uma foto bagunçada e você recebe uma malha bagunçada. Dê uma foto limpa e o mesmo modelo parece duas vezes melhor. Boa parte da qualidade que você consegue controlar acontece antes que a etapa 3D comece.
Fotografe o objeto com cuidado
Se você tem o objeto físico, um celular e uma janela bastam. Siga estas regras:
Um objeto, uma foto. Acessórios extras confundem a etapa de forma.
Fundo liso e claro. Uma folha de papel branco funciona.
Luz suave e uniforme. Sombras fortes são lidas como geometria.
Ângulo de três quartos. Mostre a frente e um dos lados ao mesmo tempo.
Nada cortado. Todas as bordas do objeto ficam dentro do quadro.
Evite acabamentos de vidro e espelho. Superfícies transparentes e muito reflexivas são onde o modelo mais erra.
Remova o fundo e aumente a resolução
Até uma foto razoável se beneficia de um recorte limpo. O modelo Remove Background no PicassoIA devolve um sujeito bem recortado sobre um fundo transparente ou liso em poucos segundos. Se a foto for pequena ou desfocada, passe-a antes pelo Real ESRGAN ou pelo Topaz Image Upscale. Bordas mais nítidas dão ao modelo de forma algo firme para seguir, e bordas borradas são o caminho para cantos derretidos.
Sem foto? Gere uma imagem de origem
Você não precisa de um objeto real. Um modelo de texto para imagem consegue criar uma imagem limpa, no estilo de produto, de qualquer coisa que você possa descrever. O Hunyuan Image 3 e o Hunyuan Image 2.1 vêm da mesma empresa dos modelos 3D, o que os torna uma dupla natural. Uma estrutura de prompt que funciona bem:
"Um único [objeto], vista de três quartos, fundo cinza claro e liso, luz de estúdio suave, sem sombra no chão, o objeto inteiro dentro do quadro."
Se o resultado está quase certo, corrija a pose ou remova um acessório fora do lugar com o Qwen Image Edit 2511 antes de enviar para a etapa 3D.
Fluxo de trabalho no ComfyUI, passo a passo
O ComfyUI é a forma mais flexível de rodar o Hunyuan3D, porque você encadeia remoção de fundo, forma, textura e exportação em um único grafo. Existem dois tipos, e eles não são intercambiáveis.
Nós locais para o modelo aberto
Os pesos abertos da 2.1 rodam por nós personalizados da comunidade na sua própria GPU. Uma configuração típica segue assim:
Atualize o ComfyUI para uma versão recente.
Instale o nó personalizado do Hunyuan3D 2.1 pelo ComfyUI Manager.
Baixe os pesos de forma e de pintura nas pastas que o nó indicar.
Monte a cadeia: Load Image, remoção de fundo, geração de forma, geração de textura opcional e, então, a exportação.
Salve a malha, geralmente como arquivo GLB, e abra-a no Blender para conferir.
💡 Economize memória e tempo: rode primeiro a etapa de forma e olhe a malha cinza. Se a silhueta estiver errada, troque a foto antes de gastar 20 GB de VRAM texturizando uma forma ruim.
Nós parceiros para a 3.0 e a 3.1
O ComfyUI também traz modelos prontos em 3D, depois Hunyuan 3D. Eles chamam o modelo hospedado, então nada roda na sua GPU. Você entra, gasta créditos e clica em Run (ou Ctrl+Enter). Os modelos da 3.0 aceitam um prompt de texto, uma única imagem ou várias vistas, e acrescentam ferramentas que os pesos abertos não têm:
Geração de imagem para 3D com textura PBR
Decomposição em partes, que separa um objeto em peças distintas
Desdobramento UV com um layout otimizado
Topologia inteligente, que reduz a contagem de polígonos ao nível que você escolher
Essa rota serve bem para notebooks e pequenos estúdios, já que a exigência de hardware se resume a um navegador e uma conexão com a internet.
Por que várias vistas superam uma foto só
A documentação do fluxo de trabalho da 3.0 recomenda de duas a quatro vistas do objeto quando você as tiver. O motivo é simples: uma foto só esconde a parte de trás, a parte de baixo e um dos lados. Com uma vista, o modelo inventa essas áreas. Com uma foto de frente, de lado e de trás, ele as mede. Se o seu objeto é real, gaste dois minutos extras fotografando mais ângulos. A melhora é maior do que qualquer ajuste de configuração.
Usando a API no lugar
Uma API serve quando a geração precisa acontecer dentro do seu próprio aplicativo: uma loja que cria prévias 3D a partir de fotos de vendedores, uma ferramenta de jogos que monta objetos a partir de esboços, um script que processa uma pasta durante a noite. O fluxo é quase idêntico entre os provedores: envie uma imagem, espere o trabalho terminar e baixe o arquivo.
# Pseudocode: the flow, not a specific provider SDK
job = client.submit(model="hunyuan3d", image_url=photo_url)
result = client.wait(job)
download(result["mesh_url"], "armchair.glb")
Quanto custam as faixas hospedadas
Os preços abaixo vêm de um provedor hospedado em outubro de 2026. Outros são diferentes, e todos mudam, então use a tabela para comparar faixas, não como cotação.
Faixa
Tipo
Preço aproximado por malha
v2 Mini / Turbo
Imagem para 3D
US$ 0,08
v2 Standard
Imagem para 3D
US$ 0,16
v3.1 Rapid
Imagem para 3D
US$ 0,225
v3.1 Pro
Imagem para 3D
US$ 0,375
v3
Imagem para 3D
US$ 0,375
Faça as contas antes de escolher. Um lote de 100 malhas custa cerca de US$ 8 na faixa mais barata e cerca de US$ 37,50 na faixa mais alta. Mil malhas ficam entre US$ 80 e US$ 375. Esses totais são pequenos para um trabalho pontual, mas somam rápido para um produto que gera malhas para cada usuário.
Quando o local vence o hospedado
Rodar os pesos abertos por conta própria, em tempo de GPU alugado, pode sair bem mais barato por malha. Um benchmark da comunidade com uma implantação hospedada da 2.1 mediu uma mediana de cerca de 139 segundos por geração, a aproximadamente 1,5 centavo de dólar por malha. O local vence quando:
você gera em lotes grandes
suas fotos são privadas ou estão sob contrato com um cliente
você quer mudar o pipeline, por exemplo acrescentando sua própria etapa de limpeza
O hospedado vence quando você precisa da qualidade da 3.x, não tem uma GPU adequada ou gera só de vez em quando.
Da malha ao objeto físico
Uma malha gerada não é automaticamente imprimível. A forma pode ter paredes finas, pequenos furos ou superfícies que se cruzam, e os fatiadores reagem mal aos três. Uma lista curta antes de mandar imprimir:
Verifique furos e arestas não variedade com um verificador de malha, como o complemento 3D-Print Toolbox no Blender.
Defina a escala real. Os modelos saem em unidades arbitrárias, então meça e redimensione.
Engrosse as partes finas. Antenas, alças e bordas de tecido costumam sair mais finas do que a impressora consegue construir.
Oriente para usar menos suportes. Deite o lado plano sobre a mesa.
Espere linhas de camada visíveis e algumas marcas de suporte na primeira impressão. Um pouco de acabamento manual transforma uma impressão tosca em algo que você colocaria em uma prateleira. Lixa fina, um estilete e um pouco de paciência removem a maioria das marcas, e uma camada fina de primer esconde o resto.
Onde o Hunyuan3D se encaixa melhor
Nenhum modelo de imagem para 3D substitui um modelador ou um software CAD. Ele substitui a primeira hora do trabalho de um modelador e, às vezes, o trabalho inteiro quando o ativo fica em segundo plano. Conheça os limites logo de início:
Ele não conhece dimensões reais, só proporções.
Estruturas finas, partes transparentes e textos sobre superfícies costumam falhar.
O lado não visto é um palpite, a menos que você forneça vistas extras.
A topologia costuma ser boa para renderização e impressão, mas raramente limpa o bastante para animação sem retopologia.
Adereços de jogos e ativos de fundo
Este é o ponto ideal. Uma caixa, um abajur, um vaso de cerâmica ou um frasco de poção precisa parecer certo a cinco metros de distância, e não precisa resistir a uma lente macro. Gere a malha, reduza os polígonos, asse as texturas e coloque-a na cena. Equipes independentes usam isso para preencher uma fase com adereços em uma tarde, em vez de uma semana.
Prévias de produto e mesas giratórias
Para uma loja, uma malha 3D permite que o cliente gire o item em vez de passar seis fotos. Você também pode renderizar uma mesa giratória a partir da malha e depois dar vida a esses quadros com um modelo de vídeo por IA para anúncios e posts em redes sociais. Veja a lista completa de modelos de imagem e vídeo em picassoia.com/en/all-models para conferir o que está disponível em cada etapa.
Experimente você mesmo no Picasso IA
O Hunyuan3D só é tão bom quanto a imagem que você lhe dá, e essa é a parte que você pode começar agora mesmo. No Picasso IA, você pode gerar uma imagem de origem limpa com o Hunyuan Image 3, recortar o sujeito com o Remove Background e aumentar a nitidez com o Real ESRGAN, tudo em uma única aba do navegador.
Escolha um objeto que você realmente queira ver em 3D: uma caneca, uma cadeira, um brinquedo, um tênis. Faça três vistas limpas dele, rode-as pela rota que cabe no seu hardware das seções acima e compare as malhas lado a lado. Depois, teste um segundo objeto com uma forma mais difícil. A diferença entre uma foto boa e uma foto apressada vai aparecer já no primeiro resultado, e alguns experimentos ensinam mais do que qualquer ficha técnica. Abra o Picasso IA, gere sua primeira imagem de origem hoje e veja até onde uma única imagem pode chegar.