Saltar al contenido
LaFoto

Directorio de modelos

Modelos de imagen con IA, descritos y no clasificados

Siete modelos que la gente nombra de verdad y para qué sirve cada uno. Sin puntuaciones, porque la respuesta depende por completo del trabajo que trae entre manos.

Estos modelos no compiten en lo mismo. Midjourney impone una estética, FLUX sigue las instrucciones al pie de la letra, Nano Banana cambia una fotografía sin perder a la persona retratada, Stable Diffusion le entrega las piezas, Recraft produce vectores editables, Seedream compone tipografía china e inglesa, y gpt-image-1 interpreta una frase compleja. Elija según cuál de esas frases describa su problema.

Cómo elegir entre ellos

La pregunta que decide casi todo es si va a crear una imagen o a cambiar una. Crear desde cero premia a un modelo con composición y adhesión al prompt; cambiar una fotografía premia a un modelo que deje intacto todo lo que usted no haya mencionado. Son requisitos casi opuestos, y una herramienta hecha para uno suele rendir regular en el otro.

La segunda pregunta es si necesita que el resultado sea reproducible. Los modelos cerrados y alojados cambian sin preaviso, y un look del que dependa comercialmente puede dejar de estar disponible con un calendario que usted no controla. Los pesos abiertos resuelven eso, a costa de operar usted mismo la infraestructura.

La tercera es el formato de salida, y suele descubrirse tarde. Si el archivo tiene que abrirse en un editor vectorial o imprimirse a dos metros, esa restricción elimina la mayor parte de esta lista antes de entrar en cuestiones de calidad.

Qué es este directorio

Entradas
Siete modelos
Clasificado
No — descritos
Afiliación
Ninguna con ninguno
Precios
Deliberadamente no indicados
Versiones
No fijadas — avanzan demasiado rápido
Actualizado
Agosto de 2026

Cómo leer una comparativa de modelos

Casi todos los rankings responden a una pregunta que usted no hizo

Las listas de los mejores modelos de imagen suelen hacerse generando el mismo puñado de prompts en cada uno y juzgando los resultados. Eso mide cómo maneja cada modelo esos prompts, lo cual solo sirve si su trabajo se parece a ellos, y un conjunto de pruebas pensado para lucir en un blog rara vez lo hace.

La pregunta útil es estructural: si el modelo crea imágenes o las cambia, si tiene una opinión estética, si puede ejecutarse por su cuenta y qué sale al otro lado —píxeles o curvas. Esas propiedades no cambian con la próxima versión y eliminan la mayor parte de la lista antes de hablar de calidad.

Siete copias fotográficas pequeñas enmarcadas dispuestas en cuadrícula en una pared de estudio pálida

Tres preguntas que reducen el campo rápido

Elija por restricciones antes que por calidad

La primera bifurcación, y la más amplia

Generar una imagen desde una descripción y editar una fotografía que ya tiene son casi problemas opuestos. Uno premia la composición y la adherencia al prompt; el otro premia dejar intacto todo lo que no mencionó.

Los modelos pensados para edición mantienen la identidad de un sujeto a través de cambios sucesivos. Los de generación le dan control sobre encuadre, óptica y estilo desde cero. Muy pocos son excelentes en ambas cosas.

  • Editar una foto existente: Nano Banana.
  • Crear desde cero: FLUX, Midjourney.
  • Ambos, conversacionalmente: gpt-image-1.
Una escena de producto editada por IA con el fondo sustituido

Preguntas sobre modelos

Lo que se pregunta antes de elegir uno

Respuestas breves; la versión larga en la página de cada modelo.

¿Por qué el mismo prompt y modelo dan imágenes diferentes?

Porque el ruido inicial varía. Un seed fija ese ruido, y prompt más seed más modelo reproducen una imagen exactamente. Cambie cualquiera de los tres y obtendrá algo relacionado pero no idéntico.

¿Un modelo más nuevo siempre es mejor?

En salida bruta, normalmente. En todo lo demás —herramientas de la comunidad, adaptadores de estilo, claridad de licencia, estabilidad de precio— a menudo no. Stable Diffusion es el caso más claro de un modelo veterano que su ecosistema mantiene vivo.

¿Puedo mover mis prompts entre modelos?

El tema y la escena se transfieren; los parámetros y la sintaxis rara vez. Los modelos difieren en cómo leen pesos, negativos y tokens de estilo, y un prompt muy afinado para uno suele estar sobreespecificado para otro.

¿Qué me da realmente que los weights sean abiertos?

La posibilidad de ejecutarlo localmente, fijar una versión para siempre, generar sin coste por imagen y mantener el material fuente fuera de infraestructuras de terceros. Le cuesta el hardware y el mantenimiento.

¿Cuál renderiza bien el texto?

Varios manejan cadenas cortas hoy, y ninguno sustituye a componer tipografía. Genere la imagen, añada las palabras en una herramienta de diseño y evitará toda la categoría de problemas.

¿Importa más el modelo que el prompt?

Por debajo de cierto nivel de prompt, no. Un prompt específico en un modelo medio supera a uno vago en el mejor modelo disponible, por eso la guía de prompts aquí es más larga que este directorio.

Una fotografía de comida generada con IA a la luz del día

Siga explorando

En otros lugares de LaFoto

El directorio describe las herramientas; esto es lo que puede hacer con ellas.

Preguntas sobre modelos de imagen con IA

¿Cuál es el mejor modelo de imagen con IA?
No hay una única respuesta, por eso este directorio describe en lugar de clasificar. Midjourney impone una estética, FLUX sigue la instrucción al pie de la letra, Nano Banana edita una fotografía sin perder a la persona en ella, Stable Diffusion le entrega las piezas, Recraft saca vectores, Seedream compone tipografía en chino e inglés, y gpt-image-1 interpreta una frase complicada. Elija por cuál de esos describe su problema.
¿Cuál es la diferencia entre un modelo abierto y uno cerrado?
Los weights abiertos pueden descargarse y ejecutarse en su propio hardware, de modo que puede fijar una versión de forma permanente, generar sin coste por imagen y mantener material fuente fuera de servidores de terceros. Los modelos cerrados se acceden mediante una API o una app, no requieren infraestructura y cambian según el calendario del proveedor y no el suyo.
¿Por qué estas páginas no listan precios o números de versión?
Porque ambos cambian más rápido de lo que se revisa una página de directorio, y una cifra obsoleta se lee como una mentira y no como desactualización. Aquí se escribe lo que permanece: quién lo hace, cómo se accede, si los weights son abiertos y para qué se ha construido que sea bueno.
¿LaFoto está afiliada a alguno de estos modelos?
No. No revendemos ninguno ni tenemos relación comercial con sus fabricantes. El único lugar donde hablamos en primera persona es en la entrada de FLUX, donde indicamos qué modelo generó las imágenes del propio sitio — una afirmación que la galería acredita tarjeta a tarjeta.
¿Puedo mover un prompt de un modelo a otro?
El sujeto y la escena se transfieren; los parámetros y la sintaxis rara vez. Los modelos difieren en cómo leen pesos, negativos y tokens de estilo, y un prompt muy afinado para uno suele estar sobre-especificado para otro.
¿Un modelo más nuevo siempre es mejor que uno antiguo?
En calidad de salida pura, por lo general sí. En todo lo que lo rodea —herramientas de la comunidad, adaptadores de estilo, claridad de licencia— a menudo no. Stable Diffusion es el ejemplo más claro de un modelo antiguo mantenido vigente por su ecosistema y no por sus resultados.
¿Qué modelo debería usar para editar una foto que ya tengo?
Uno construido para edición y no para generación. La capacidad distintiva es mantener un sujeto reconocible de forma constante a lo largo de cambios sucesivos, algo que la mayoría de modelos texto-a-imagen pierden tras una o dos ediciones.
¿Alguno de ellos renderiza texto de forma fiable?
Varios manejan cadenas cortas lo bastante bien como para diseñar a su alrededor, y ninguno sustituye a componer tipografía. Genere la imagen y añada las palabras en una herramienta de diseño: la rotulación generada no se puede editar, corregir ni traducir después.

Empiece a crear hoy

Genere su primera imagen con el mejor generador de imágenes con IA.

Convierta una frase en una imagen terminada y fotorrealista en segundos — y luego afine cada detalle. Sin configuración, sin Discord, sin GPU.

Únase a 4200+ creadores que usan LaFoto