Saltar al contenido
LaFoto

Glosario de imagen con IA

El vocabulario que un generador de imágenes con IA espera que ya conozca

Cada término de abajo aparece en una interfaz real o en un prompt real. Cada uno se define primero en una frase, porque una definición que tenga que leer dos veces ha fallado.

La mayor dificultad con la generación de imágenes con IA es el vocabulario más que la técnica. Seed, intensidad de denoise, escala de guía e inpainting nombran cada uno un comportamiento específico, y cuando la palabra significa algo el control se vuelve obvio. Estos son los términos que merece la pena conocer, en el orden en que se encuentra con ellos.

Cómo funciona la generación

Difusión
La técnica detrás de la mayoría de modelos de imagen actuales: se entrena añadiendo ruido a imágenes reales y aprendiendo a revertirlo, y luego se ejecuta a la inversa desde ruido puro para generar.
Texto a imagen
Generación de una imagen nueva a partir de una descripción escrita únicamente, sin imagen de origen. También llamado texto a foto cuando la salida buscada es fotográfica.
Imagen a imagen
Generación de una imagen nueva a partir de otra existente más un prompt, donde la fuerza de denoise controla cuánto sobrevive del original.
Checkpoint
Un conjunto guardado de pesos del modelo. Checkpoints distintos de la misma arquitectura producen salidas visiblemente diferentes con prompts idénticos.

Controles y parámetros

Seed
El número que determina el ruido inicial desde el que arranca una generación. Con el mismo seed, el mismo prompt y el mismo modelo, se reproduce la misma imagen.
Fuerza de denoise
En image-to-image, cuánto de su imagen de origen se descarta antes de regenerar. Valores bajos preservan el original; valores altos lo tratan como una referencia laxa.
Escala de guía
Con qué fuerza se empuja al modelo hacia su prompt en cada paso. Demasiado baja y divaga; demasiado alta y la salida se vuelve rígida y sobresaturada.
LoRA
Un pequeño complemento entrenado que enseña a un modelo base un estilo, personaje u objeto concreto sin reentrenar el modelo completo.
Prompt negativo
Un campo independiente que describe lo que se debe evitar. No todos los endpoints lo admiten; donde no lo hacen, todo lo que escriba es una instrucción positiva.
Sampler
El algoritmo que marca los pasos del proceso de eliminación de ruido. Samplers distintos convergen a distintas velocidades y producen resultados ligeramente diferentes con el mismo seed.

Operaciones de edición

Inpainting
Regenerar una región enmascarada dentro de una imagen dejando intacto todo lo que queda fuera de la máscara. La base para eliminar objetos y editar de forma localizada.
Outpainting
Generación de contenido nuevo más allá de los bordes originales del encuadre, para ampliar una fotografía a una relación de aspecto mayor sin recortar.

Archivos y salida

Relación de aspecto
La proporción entre el ancho y el alto de una imagen, como 1:1, 4:5 o 16:9. Se elige antes de generar, porque el modelo compone para el encuadre.
Escalado
Ampliación de una imagen más allá de sus dimensiones de píxel originales. El escalado con IA reconstruye detalle verosímil en lugar de interpolar entre píxeles existentes.
Canal alfa
La capa de transparencia en una imagen. PNG y WebP la admiten; JPEG no, por eso un recorte con transparencia guardado como JPEG adquiere un fondo sólido.
EXIF
Metadatos incrustados en una fotografía que registran cámara, objetivo, exposición, fecha y a menudo coordenadas GPS. Se eliminan cada vez que se vuelve a codificar el archivo.

Cómo funciona este glosario

Términos
Solo los que verá en una interfaz real
Definiciones
Siempre una frase primero
Página propia
Solo donde un párrafo no baste
Esquema
DefinedTermSet, con miembros enlazados
Actualizado
Cuando cambia el comportamiento del modelo
Coste
Gratis, sin cuenta

En la práctica

La mayor dificultad de la imagen con IA es el vocabulario

Seed, denoise strength, guidance scale e inpainting nombran cada uno un comportamiento concreto. Cuando la palabra significa algo, el control que describe se vuelve obvio, y hasta entonces la interfaz parece un muro de deslizadores arbitrarios.

Por eso aquí la definición va primero y la explicación después. Una definición que deba leerse dos veces ha fallado en el único trabajo que tenía.

Un libro técnico de referencia abierto sobre papel cálido con una lupa apoyada en una página de diagramas

Tres formas de empezar

Por dónde empezar

Cómo se crean las imágenes

Diffusion, text to image, image to image y checkpoints. La mecánica que explica por qué el mismo prompt da resultados distintos.

  • Empiece por diffusion y luego seed.
  • Text to image e image to image son modos distintos.
  • Los checkpoints cambian el resultado más que los prompts.
Un estudio de retrato generado por IA

Detalle

Preguntas del glosario

Las dudas de vocabulario más frecuentes.

Por qué el mismo prompt da imágenes distintas

No se fijó el seed. La generación parte de ruido aleatorio, y el punto de partida afecta más al resultado que la mayoría de cambios en el prompt.

Qué hace denoise strength

Determina cuánto de una imagen fuente sobrevive en una generación image to image. Es el control más importante en ese modo.

La diferencia entre inpainting y outpainting

Inpainting regenera dentro del encuadre; outpainting genera más allá de sus bordes. Misma operación, zona distinta.

Si un seed funciona entre modelos

No. Un seed indexa en el espacio de ruido de un modelo, así que el mismo número en otro sitio produce algo no relacionado.

Por qué conviene elegir antes la relación de aspecto

El modelo compone para el encuadre que recibe, de modo que recortar después descarta una disposición que creó a propósito.

Una fotografía de producto generada con IA sobre fondo infinito blanco

Siga explorando

En otros apartados de LaFoto

Cada término aquí describe algo que hace una de estas herramientas.

Vocabulary

Preguntas sobre términos de imagen con IA

¿Qué es un seed en generación de imágenes con IA?
Un seed es el número que fija el ruido aleatorio desde el que empieza una generación. El mismo seed, prompt y modelo reproducen la misma imagen, por eso fijarlo es la única forma de probar qué cambió realmente al modificar una sola palabra.
¿Qué controla la intensidad de denoise?
Cuánta parte de su imagen de origen sobrevive en una generación de imagen a imagen. A 0.2 la fotografía permanece esencialmente intacta; a 0.5 se mantiene la composición mientras se renegocia el contenido; a 0.85 la fuente es poco más que un moodboard.
¿Cuál es la diferencia entre inpainting y outpainting?
Inpainting regenera una región enmascarada dentro del encuadre existente; outpainting genera contenido nuevo más allá de los bordes originales. La misma operación dirigida a zonas distintas: una repara, la otra amplía.
¿Qué es la guidance scale?
Cuán fuerte se empuja al modelo hacia su prompt en cada paso de des-ruido. Demasiado baja y se aleja de sus palabras; demasiado alta y la salida se vuelve rígida y sobre-saturada al sobrecorregir.
¿Qué es una LoRA?
Un complemento pequeño entrenado que enseña a un modelo base un estilo, personaje u objeto específicos sin reentrenar el modelo completo. Es como los usuarios de modelos abiertos logran personajes consistentes en muchas imágenes.
¿Por qué hay que elegir la relación de aspecto antes de generar?
El modelo compone para el encuadre que recibe, organizando una escena horizontal para 16:9 y vertical para 4:5. Recortar después descarta composición que creó deliberadamente.
¿Qué es un canal alfa?
La capa de transparencia en un archivo de imagen. PNG y WebP lo admiten; JPEG no, por eso un sujeto recortado guardado como JPEG adquiere un fondo blanco sólido.
¿Un seed funciona en un modelo diferente?
No. Un seed indexa el espacio de ruido de un modelo específico, así que el mismo número en otro modelo —o a menudo en otra versión del mismo— produce algo no relacionado. Anote el modelo junto a él.

Empiece a crear hoy

Genere su primera imagen con el mejor generador de imágenes con IA.

Convierta una frase en una imagen terminada y fotorrealista en segundos — y luego afine cada detalle. Sin configuración, sin Discord, sin GPU.

Únase a 4200+ creadores que usan LaFoto