Directorio de modelos
Modelos de imagen con IA, descritos y no clasificados
Siete modelos que la gente nombra de verdad y para qué sirve cada uno. Sin puntuaciones, porque la respuesta depende por completo del trabajo que trae entre manos.
El directorio
- GoogleNano BananaEl editor de imágenes conversacional de Google. Mantiene un rostro coherente entre ediciones.
- Stability AIStable DiffusionEl modelo abierto del que nació todo el ecosistema. LoRAs, ControlNet, checkpoints.
- Black Forest LabsFLUX.1Creado por exinvestigadores de Stable Diffusion. Lee los prompts literalmente y renderiza texto.
- Midjourney, Inc.MidjourneyEl que tiene estilo propio. Con criterio, cerrado y solo por suscripción.
- RecraftRecraftEl que saca vectores reales. Pensado para marca y diseño.
- ByteDanceSeedreamEl modelo de ByteDance. Renderizado de texto bilingüe sólido y alta resolución nativa.
- OpenAIgpt-image-1El modelo detrás de las imágenes de ChatGPT. Sigue las instrucciones y renderiza texto con solvencia.
Cómo elegir entre ellos
La pregunta que decide casi todo es si va a crear una imagen o a cambiar una. Crear desde cero premia a un modelo con composición y adhesión al prompt; cambiar una fotografía premia a un modelo que deje intacto todo lo que usted no haya mencionado. Son requisitos casi opuestos, y una herramienta hecha para uno suele rendir regular en el otro.
La segunda pregunta es si necesita que el resultado sea reproducible. Los modelos cerrados y alojados cambian sin preaviso, y un look del que dependa comercialmente puede dejar de estar disponible con un calendario que usted no controla. Los pesos abiertos resuelven eso, a costa de operar usted mismo la infraestructura.
La tercera es el formato de salida, y suele descubrirse tarde. Si el archivo tiene que abrirse en un editor vectorial o imprimirse a dos metros, esa restricción elimina la mayor parte de esta lista antes de entrar en cuestiones de calidad.
Qué es este directorio
- Entradas
- Siete modelos
- Clasificado
- No — descritos
- Afiliación
- Ninguna con ninguno
- Precios
- Deliberadamente no indicados
- Versiones
- No fijadas — avanzan demasiado rápido
- Actualizado
- Agosto de 2026
Cómo leer una comparativa de modelos
Casi todos los rankings responden a una pregunta que usted no hizo
Las listas de los mejores modelos de imagen suelen hacerse generando el mismo puñado de prompts en cada uno y juzgando los resultados. Eso mide cómo maneja cada modelo esos prompts, lo cual solo sirve si su trabajo se parece a ellos, y un conjunto de pruebas pensado para lucir en un blog rara vez lo hace.
La pregunta útil es estructural: si el modelo crea imágenes o las cambia, si tiene una opinión estética, si puede ejecutarse por su cuenta y qué sale al otro lado —píxeles o curvas. Esas propiedades no cambian con la próxima versión y eliminan la mayor parte de la lista antes de hablar de calidad.

Tres preguntas que reducen el campo rápido
Elija por restricciones antes que por calidad
La primera bifurcación, y la más amplia
Generar una imagen desde una descripción y editar una fotografía que ya tiene son casi problemas opuestos. Uno premia la composición y la adherencia al prompt; el otro premia dejar intacto todo lo que no mencionó.
Los modelos pensados para edición mantienen la identidad de un sujeto a través de cambios sucesivos. Los de generación le dan control sobre encuadre, óptica y estilo desde cero. Muy pocos son excelentes en ambas cosas.
- Editar una foto existente: Nano Banana.
- Crear desde cero: FLUX, Midjourney.
- Ambos, conversacionalmente: gpt-image-1.

Quién controla aquello de lo que depende
Los modelos cerrados hospedados cambian por debajo de usted. Un look sobre el que construyó una marca puede dejar de ser reproducible con un calendario que no fija, y no hay versión que fijar.
Open weights lo evitan y le entregan a cambio el problema de la infraestructura: hardware, almacenamiento, actualizaciones y una canalización que se rompe cuando se mueve una dependencia.
- Importa la reproducibilidad: Stable Diffusion, FLUX.
- Sin apetito de infraestructura: cualquiera hospedado.
- Volumen y privacidad empujan al autoalojamiento.

La restricción que la gente descubre al final
Si la salida debe abrirse en un editor vectorial, escalar a un edificio o recolorearse por otro el año que viene, un ráster es el artefacto equivocado por muy bien que se vea.
De igual modo, si debe llevar tipografía legible en un idioma con miles de caracteres, eso elimina gran parte de esta lista antes de considerar nada más.
- Curvas editables: Recraft.
- Tipografía en chino e inglés: Seedream.
- Todo lo demás: píxeles ráster.

Preguntas sobre modelos
Lo que se pregunta antes de elegir uno
Respuestas breves; la versión larga en la página de cada modelo.
¿Por qué el mismo prompt y modelo dan imágenes diferentes?
Porque el ruido inicial varía. Un seed fija ese ruido, y prompt más seed más modelo reproducen una imagen exactamente. Cambie cualquiera de los tres y obtendrá algo relacionado pero no idéntico.
¿Un modelo más nuevo siempre es mejor?
En salida bruta, normalmente. En todo lo demás —herramientas de la comunidad, adaptadores de estilo, claridad de licencia, estabilidad de precio— a menudo no. Stable Diffusion es el caso más claro de un modelo veterano que su ecosistema mantiene vivo.
¿Puedo mover mis prompts entre modelos?
El tema y la escena se transfieren; los parámetros y la sintaxis rara vez. Los modelos difieren en cómo leen pesos, negativos y tokens de estilo, y un prompt muy afinado para uno suele estar sobreespecificado para otro.
¿Qué me da realmente que los weights sean abiertos?
La posibilidad de ejecutarlo localmente, fijar una versión para siempre, generar sin coste por imagen y mantener el material fuente fuera de infraestructuras de terceros. Le cuesta el hardware y el mantenimiento.
¿Cuál renderiza bien el texto?
Varios manejan cadenas cortas hoy, y ninguno sustituye a componer tipografía. Genere la imagen, añada las palabras en una herramienta de diseño y evitará toda la categoría de problemas.
¿Importa más el modelo que el prompt?
Por debajo de cierto nivel de prompt, no. Un prompt específico en un modelo medio supera a uno vago en el mejor modelo disponible, por eso la guía de prompts aquí es más larga que este directorio.

Siga leyendo
A dónde ir desde el directorio
Siga explorando
En otros lugares de LaFoto
El directorio describe las herramientas; esto es lo que puede hacer con ellas.
- redimensione a píxeles exactos
- convierta un formato de imagen
- compresor de imágenes
- recorte una imagen
- extraiga colores de una imagen
- elimine un fondo
- visor EXIF
- Generador de prompts con IA
- generador de anime con IA
- convertir una foto en dibujo animado
- generador de pixel art
- qué generador elegir
- comparada con Midjourney
- comparada con Leonardo
- alternativa a Ideogram
- alternativa a Canva para imágenes
- seeds explicados
- qué es la intensidad de denoise
- edición dentro de una máscara
- el blog de LaFoto
Preguntas sobre modelos de imagen con IA
- ¿Cuál es el mejor modelo de imagen con IA?
- No hay una única respuesta, por eso este directorio describe en lugar de clasificar. Midjourney impone una estética, FLUX sigue la instrucción al pie de la letra, Nano Banana edita una fotografía sin perder a la persona en ella, Stable Diffusion le entrega las piezas, Recraft saca vectores, Seedream compone tipografía en chino e inglés, y gpt-image-1 interpreta una frase complicada. Elija por cuál de esos describe su problema.
- ¿Cuál es la diferencia entre un modelo abierto y uno cerrado?
- Los weights abiertos pueden descargarse y ejecutarse en su propio hardware, de modo que puede fijar una versión de forma permanente, generar sin coste por imagen y mantener material fuente fuera de servidores de terceros. Los modelos cerrados se acceden mediante una API o una app, no requieren infraestructura y cambian según el calendario del proveedor y no el suyo.
- ¿Por qué estas páginas no listan precios o números de versión?
- Porque ambos cambian más rápido de lo que se revisa una página de directorio, y una cifra obsoleta se lee como una mentira y no como desactualización. Aquí se escribe lo que permanece: quién lo hace, cómo se accede, si los weights son abiertos y para qué se ha construido que sea bueno.
- ¿LaFoto está afiliada a alguno de estos modelos?
- No. No revendemos ninguno ni tenemos relación comercial con sus fabricantes. El único lugar donde hablamos en primera persona es en la entrada de FLUX, donde indicamos qué modelo generó las imágenes del propio sitio — una afirmación que la galería acredita tarjeta a tarjeta.
- ¿Puedo mover un prompt de un modelo a otro?
- El sujeto y la escena se transfieren; los parámetros y la sintaxis rara vez. Los modelos difieren en cómo leen pesos, negativos y tokens de estilo, y un prompt muy afinado para uno suele estar sobre-especificado para otro.
- ¿Un modelo más nuevo siempre es mejor que uno antiguo?
- En calidad de salida pura, por lo general sí. En todo lo que lo rodea —herramientas de la comunidad, adaptadores de estilo, claridad de licencia— a menudo no. Stable Diffusion es el ejemplo más claro de un modelo antiguo mantenido vigente por su ecosistema y no por sus resultados.
- ¿Qué modelo debería usar para editar una foto que ya tengo?
- Uno construido para edición y no para generación. La capacidad distintiva es mantener un sujeto reconocible de forma constante a lo largo de cambios sucesivos, algo que la mayoría de modelos texto-a-imagen pierden tras una o dos ediciones.
- ¿Alguno de ellos renderiza texto de forma fiable?
- Varios manejan cadenas cortas lo bastante bien como para diseñar a su alrededor, y ninguno sustituye a componer tipografía. Genere la imagen y añada las palabras en una herramienta de diseño: la rotulación generada no se puede editar, corregir ni traducir después.
Lecturas recomendadas
Empiece a crear hoy
Genere su primera imagen con el mejor generador de imágenes con IA.
Convierta una frase en una imagen terminada y fotorrealista en segundos — y luego afine cada detalle. Sin configuración, sin Discord, sin GPU.
Únase a 4200+ creadores que usan LaFoto