Diretório de modelos
Modelos de imagem por IA, descritos em vez de ranqueados
Sete modelos que as pessoas realmente citam — e para que cada um serve de verdade. Sem notas, porque a resposta depende inteiramente do trabalho que você trouxe.
O diretório
- GoogleNano BananaEditor de imagem conversacional do Google. Mantém o rosto consistente entre edições.
- Stability AIStable DiffusionO modelo aberto a partir do qual todo o ecossistema cresceu. LoRAs, ControlNet, checkpoints.
- Black Forest LabsFLUX.1Feito por ex-pesquisadores do Stable Diffusion. Lê prompts literalmente, renderiza texto.
- Midjourney, Inc.MidjourneyO modelo com estilo próprio da casa. Opinativo, fechado, só por assinatura.
- RecraftRecraftO modelo que exporta vetores de verdade. Feito para marca e design.
- ByteDanceSeedreamO modelo da ByteDance. Forte renderização bilíngue de texto e alta resolução nativa.
- OpenAIgpt-image-1O modelo por trás das imagens no ChatGPT. Segue instruções e escreve texto legível.
Como escolher entre eles
A pergunta que decide a maior parte é se você está criando uma imagem do zero ou alterando uma. Criar uma imagem do nada favorece um modelo com composição e aderência ao prompt; alterar uma fotografia favorece um modelo que deixe intacto tudo o que você não mencionou. São requisitos quase opostos, e uma ferramenta feita para um costuma ser mediana no outro.
A segunda pergunta é se você precisa que o resultado seja reprodutível. Modelos fechados e hospedados mudam sob você, e um visual do qual seu negócio depende pode deixar de estar disponível em um cronograma que você não controla. Pesos abertos resolvem isso ao custo de operar a infraestrutura por conta própria.
A terceira é o formato de saída, e costuma ser descoberta tarde demais. Se o arquivo precisa abrir em um editor vetorial ou imprimir a dois metros, essa exigência elimina a maior parte desta lista antes de qualquer discussão de qualidade.
O que é este diretório
- Entradas
- Sete modelos
- Classificados
- Não — descritos
- Vínculo
- Nenhum com qualquer um deles
- Preços
- Deliberadamente não listados
- Versões
- Não fixadas — evoluem rápido demais
- Atualizado
- Agosto de 2026
Como ler uma comparação de modelos
Quase toda classificação responde a uma pergunta que o senhor não fez
Listas do melhor modelo de imagem geralmente são feitas gerando o mesmo punhado de prompts em cada um e julgando os resultados. Isso mede como cada modelo lida com aqueles prompts — útil apenas se o seu trabalho se parecer com eles, e um conjunto de prompts escolhido para ficar bonito num post raramente parece.
A pergunta mais útil é estrutural: este modelo cria imagens ou as edita, ele tem opinião estética, dá para o senhor executá-lo localmente e o que sai do outro lado — pixels ou curvas. Essas propriedades não mudam no próximo release e eliminam a maior parte da lista antes de a qualidade entrar na conversa.

Três perguntas que estreitam o campo rápido
Escolha por restrição antes de escolher por qualidade
A primeira bifurcação, e a mais ampla
Gerar uma imagem a partir de uma descrição e editar uma foto que o senhor já tem são problemas quase opostos. Um recompensa composição e aderência ao prompt; o outro recompensa deixar intocado tudo o que não foi mencionado.
Modelos feitos para edição mantêm a identidade de um sujeito ao longo de mudanças sucessivas. Modelos feitos para geração dão controle de enquadramento, ótica e estilo a partir do nada. Pouquíssimos são excelentes nos dois.
- Editar uma foto existente: Nano Banana.
- Criar do zero: FLUX, Midjourney.
- Ambos, de forma conversacional: gpt-image-1.

Quem controla aquilo de que o senhor depende
Modelos fechados e hospedados mudam por baixo de si. Um visual no qual o senhor baseou uma marca pode deixar de ser reproduzível em um cronograma que não é o seu, e não há versão para fixar.
Weights abertos resolvem isso e, em troca, entregam o problema de infraestrutura — hardware, armazenamento, atualizações e um pipeline que quebra quando uma dependência se move.
- Reprodutibilidade importa: Stable Diffusion, FLUX.
- Sem apetite por infraestrutura: qualquer hospedado.
- Volume e privacidade puxam para auto-hospedagem.

A restrição que as pessoas descobrem por último
Se a saída precisa abrir em um editor vetorial, escalar para um prédio ou ser recolorida por outra pessoa no ano que vem, um raster é o artefato errado por melhor que pareça.
Da mesma forma, se precisa carregar texto legível em um idioma com milhares de caracteres, isso elimina a maior parte desta lista antes de qualquer outra coisa.
- Curvas editáveis: Recraft.
- Tipos em chinês e inglês: Seedream.
- Todo o resto: pixels raster.

Perguntas sobre modelos
O que as pessoas perguntam antes de escolher
Respostas curtas; a versão longa está na página de cada modelo.
Por que o mesmo prompt e modelo geram imagens diferentes?
Porque o ruído inicial muda. Um seed fixa esse ruído; prompt mais seed mais modelo reproduzem a imagem exatamente. Alterar qualquer um dos três gera algo aparentado, mas não idêntico.
Um modelo mais novo é sempre melhor?
Em saída bruta, geralmente. Em tudo ao redor — ferramentas da comunidade, adaptadores de estilo, clareza de licença, estabilidade de preço — muitas vezes não. Stable Diffusion é o caso mais claro de um modelo mais antigo mantido vivo pelo ecossistema.
Posso levar meus prompts entre modelos?
O assunto e a cena transferem; os parâmetros e a sintaxe, raramente. Os modelos diferem em como leem pesos, negativos e tokens de estilo, e um prompt muito afinado para um costuma ficar superespecificado para outro.
O que “weights abertos” realmente me dão?
A capacidade de rodar localmente, fixar uma versão para sempre, gerar sem custo por imagem e manter material-fonte fora de infraestrutura de terceiros. O custo é o hardware e a manutenção.
Qual deles renderiza texto direito?
Vários lidam bem com strings curtas hoje, e nenhum substitui compor tipografia. Gere a imagem e adicione as palavras em uma ferramenta de design — assim o senhor evita toda essa categoria de problema.
O modelo importa mais do que o prompt?
Abaixo de certo padrão de prompt, não. Um prompt específico num modelo mediano supera um vago no melhor modelo disponível — motivo pelo qual a orientação sobre prompt aqui é maior que este diretório.

Leia a seguir
Para onde ir a partir do diretório
Continue explorando
Em outros lugares na LaFoto
O diretório descreve as ferramentas; isto é o que o senhor faz com elas.
- redimensionar para pixels exatos
- converter o formato de uma imagem
- compactador de imagem
- cortar uma imagem
- extrair cores de uma imagem
- remover um fundo
- visualizador de EXIF
- gerador de prompt com IA
- gerador de anime com IA
- transformar uma imagem em desenho animado
- gerador de pixel art
- qual gerador escolher
- comparada ao Midjourney
- comparada ao Leonardo
- alternativa ao Ideogram
- alternativa ao Canva para imagens
- explicação de seed
- o que é denoise strength
- edição dentro de uma máscara
- o jornal da LaFoto
Dúvidas sobre modelos de imagem por IA
- Qual modelo de imagem de IA é o melhor?
- Não há resposta única, por isso este diretório descreve em vez de ranquear. Midjourney impõe uma estética, FLUX segue a instrução ao pé da letra, Nano Banana edita uma fotografia sem “perder” a pessoa nela, Stable Diffusion entrega as peças, Recraft gera vetores, Seedream compõe texto em chinês e inglês, e gpt-image-1 interpreta uma frase complicada. Escolha pelo que descreve o seu problema.
- Qual a diferença entre um modelo aberto e um fechado?
- Pesos abertos podem ser baixados e executados no seu próprio hardware, permitindo fixar uma versão permanentemente, gerar sem custo por imagem e manter material-fonte fora de servidores de terceiros. Modelos fechados são acessados por uma API ou app, não exigem infraestrutura e mudam no cronograma do provedor, não no seu.
- Por que estas páginas não listam preços ou números de versão?
- Porque ambos mudam mais rápido do que uma página de diretório é revisada, e um número vencido soa como mentira, não como desatualização. O que está escrito aqui é a parte que persiste — quem faz, como acessar, se os pesos são abertos e para que foi projetado ser bom.
- A LaFoto é afiliada a algum desses modelos?
- Não. Não revendemos nenhum deles e não temos relação comercial com seus criadores. O único lugar em que aparecemos na primeira pessoa é na entrada do FLUX, onde dizemos qual modelo gerou as imagens deste site — uma afirmação que a galeria comprova cartão a cartão.
- Posso mover um prompt de um modelo para outro?
- O assunto e a cena se transferem; os parâmetros e a sintaxe raramente. Os modelos diferem em como interpretam pesos, negativos e tokens de estilo, e um prompt ajustado ao extremo para um costuma ficar superespecificado para outro.
- Um modelo mais novo é sempre melhor que um mais antigo?
- Em qualidade bruta de saída, geralmente. Em tudo ao redor — ferramentas da comunidade, adaptadores de estilo, clareza de licença — muitas vezes não. Stable Diffusion é o exemplo mais claro de um modelo antigo mantido relevante pelo ecossistema, não pelos resultados.
- Qual modelo devo usar para editar uma foto que já tenho?
- Um construído para edição e não para geração. A capacidade distintiva é manter um sujeito reconhecível e constante ao longo de mudanças sucessivas, algo que a maioria dos modelos texto-para-imagem perde após uma ou duas edições.
- Algum deles renderiza texto de forma confiável?
- Vários lidam bem com strings curtas a ponto de permitir projetar ao redor disso, e nenhum substitui diagramar texto. Gere a imagem e adicione as palavras em uma ferramenta de design — letras geradas não podem ser editadas, ter ortografia verificada ou ser traduzidas depois.
Leituras relacionadas
Comece a criar hoje
Gere sua primeira imagem com o melhor gerador de imagens por IA.
Transforme uma frase em uma imagem finalizada e fotorrealista em segundos — depois refine cada detalhe. Sem configuração, sem Discord, sem GPU.
Junte-se a 4.200+ criadores que usam a LaFoto