Sección 1 · Lección 1 de 6
¿Qué es AIGC? Cómo la IA genera imágenes y video
AIGC (contenido generado por IA) es la IA que crea algo nuevo, como una imagen, un video, una canción o un texto, en lugar de solo reconocer lo que ya existe. Un modelo de imagen primero encuentra la idea en una «biblioteca de conceptos» y luego quita ruido aleatorio paso a paso hasta que aparece la imagen que pediste. Un modelo de video hace lo mismo a lo largo del tiempo, así que todo el clip se mantiene coherente del primer fotograma al último.
AIGC frente a la IA tradicional: el crítico gastronómico y el chef
La IA tradicional reconoce cosas que ya existen. Funciona como un crítico gastronómico: le muestras un plato y te dice «esto es pasta, esto es una hamburguesa, esto es un pastel». Desbloquear el teléfono con tu cara funciona igual.
La AIGC funciona como un chef. No le muestras comida: le haces un pedido, como «una pizza picante con piña y extra de queso», y prepara un plato nuevo desde cero en lugar de darte una pizza congelada del refrigerador. Del mismo modo, puede dibujar una cara que nunca ha existido.




Paso 1: Imaginación, una biblioteca de conceptos
Antes de dibujar nada, el modelo busca la idea en lo que se llama espacio latente. Imagina una biblioteca enorme sin libros, solo con propiedades, donde las cosas parecidas están cerca unas de otras: un rincón peludo, un rincón mecánico, un rincón de comida.

Si pides un gato, el modelo va al punto donde se juntan «peludo», «orejas puntiagudas» y «bigotes». Si pides un gato robot, va a medio camino entre el rincón mecánico y el rincón peludo. No copia un gato de memoria: construye uno nuevo a partir de la receta que encuentra ahí.

Paso 2: Creación, del ruido a la imagen
Los modelos de imagen usan un proceso llamado difusión. Empiezan con una pantalla de ruido aleatorio, como un televisor sin señal. Con un prompt como «a cat eating pizza», el modelo se pregunta: si cambio un poco estos puntos, ¿se parecerá más a un gato? Lo repite muchas veces, quitando ruido paso a paso, hasta que aparece una imagen nítida.

Por eso se parece más a esculpir que a pintar. Un pintor añade pintura a un lienzo en blanco; el modelo va tallando el ruido hasta que aparece la imagen.


Cómo genera video la IA
El video es más difícil porque añade el tiempo. Si generas 24 imágenes sueltas de un gato, obtienes 24 gatos ligeramente distintos; al reproducirlas seguidas, parpadean. Un modelo de video dibuja a la vez todas las páginas del libro animado: mientras dibuja un fotograma, mira los fotogramas de alrededor, así que el color del pelaje no cambia y el movimiento fluye.
Trabaja con pequeños bloques llamados parches de espacio-tiempo. Imagina un clip de cinco segundos como un bloque de hielo: el frente es el segundo 0 y la profundidad es el tiempo. El modelo corta el bloque en miles de cubitos, y cada cubito sabe cómo es una pequeña parte de la imagen y cómo se mueve. Encajar esas piezas en movimiento es lo que evita que un personaje cambie de ropa de repente o desaparezca.

¿Cómo sabe la IA cómo es un gato?
Aprendió de una cantidad enorme de imágenes etiquetadas, como una foto de un gato con la etiqueta «gato». Dicho de forma sencilla, no guarda las fotos: aprende la receta. Los gatos suelen tener dos orejas puntiagudas, bigotes y pelaje.
Qué significa esto cuando haces videos con IA
- Cada resultado parte de un ruido nuevo, así que el mismo prompt da una imagen distinta cada vez. Genera varias versiones y quédate con la mejor.
- Describe las propiedades que quieres, como «orange tabby cat, blue scarf, lantern festival at sunset». Así el modelo encuentra el lugar correcto de su biblioteca.
- Para tener el mismo personaje en cada plano, dale referencias al modelo en lugar de esperar que acierte dos veces con la misma cara. La Lección 4 y la Lección 6 te enseñan cómo.
Términos clave
- AIGC: contenido generado por IA, es decir, imágenes, video, música o texto que crea un modelo de IA.
- Espacio latente: el mapa de conceptos del modelo, donde las ideas parecidas están cerca unas de otras.
- Difusión: crear una imagen partiendo de ruido aleatorio y quitándolo paso a paso.
- Parche de espacio-tiempo: un pequeño trozo de un video que contiene a la vez una parte de la imagen y cómo se mueve durante un breve tiempo.
Preguntas frecuentes
¿Qué significa AIGC?
Son las siglas en inglés de AI-generated content, contenido generado por IA: imágenes, video, música y texto que crea un modelo de IA, en lugar de solo analizarlos.
¿Qué diferencia hay entre la AIGC y la IA tradicional?
La IA tradicional reconoce y etiqueta cosas que ya existen, como el desbloqueo facial del teléfono. La AIGC crea algo nuevo a partir de una petición, como la imagen de una cara que nunca ha existido.
¿Cómo funciona un generador de imágenes con IA?
Busca la idea en el espacio latente, un mapa de conceptos, y luego usa la difusión: parte de ruido aleatorio y lo va quitando paso a paso hasta que la imagen coincide con el prompt.
¿Por qué el video con IA es más difícil que las imágenes?
El video añade el tiempo. El modelo tiene que mantener coherentes todos los fotogramas, así que genera el clip entero a la vez en pequeños parches de espacio-tiempo en lugar de dibujar cada fotograma por separado.
Transcripción
0:00 · Qué es AIGC
¿Qué es AIGC? El contenido generado por IA se refiere a la inteligencia artificial que puede crear contenido nuevo en lugar de solo analizar datos existentes. La IA tradicional se centra en reconocer patrones, como desbloquear el teléfono con tu cara. La AIGC se centra en la creación: genera una cara nueva que no existía antes en el mundo real.
0:23 · El crítico gastronómico y el chef
La IA tradicional era como un crítico gastronómico. Le muestras un plato y lo analiza: «Esto es pasta. Esto es una hamburguesa. O esto es un pastel». Identifica y etiqueta cosas que ya existen. La AIGC es como un chef. No le muestras comida. Le haces un pedido: «Quiero una pizza picante con piña y extra de queso». Entonces va a la cocina y prepara un plato nuevo desde cero. No va simplemente al refrigerador a darte una pizza congelada. La hace fresca, una que nunca antes había existido.
0:58 · Paso 1: la imaginación en el espacio latente
Cómo genera imágenes la IA El primer paso es la imaginación. Imagina el espacio latente como una gran biblioteca de rincones: conceptos. Cómo funciona: en esta biblioteca no hay libros, sino propiedades. Cada objeto se coloca según lo parecido que es a los demás. Imagina una enorme sala de biblioteca. Un rincón es el rincón peludo, otro es el rincón mecánico, y otro es el rincón de la comida. Si pides un gato, la IA vuela al punto de la biblioteca donde se juntan lo peludo, las orejas puntiagudas y los bigotes. Si pides un gato robot, la IA encuentra un punto justo a medio camino entre el rincón mecánico y el rincón peludo. Por qué es importante: la IA no copia un gato de su memoria. Va a las coordenadas del gato en su cerebro y construye uno nuevo basándose en las recetas que encuentra en esas coordenadas.
1:56 · Paso 2: la creación con difusión
El segundo paso es la creación. Una vez que la IA tiene una idea, necesita convertirla en una imagen. Usa un proceso llamado difusión. La IA empieza con una pantalla llena de ruido estático, como una tele sin señal. Le dices a la IA: «Muéstrame un gato comiendo pizza». Mira el ruido y se pregunta: «Si cambio un poco estos puntos, ¿se parecerá más a un gato?» Lo repite miles de veces, quitando el ruido hasta que aparece una imagen nítida y en alta definición. No pinta como un humano que añade pintura a un lienzo en blanco; esculpe orden a partir del caos.
2:37 · Cómo genera video la IA
Cómo genera videos la IA Generar video, como Sora, Runway o Kling, es mucho más difícil porque añade una nueva dimensión: el tiempo. Si le pides a la IA 24 imágenes de un gato, obtendrás 24 gatos distintos. Al unirlas en un video, el video parpadeará y se verá caótico. La IA de video genera a la vez todas las páginas de un libro animado. Cuando dibuja la página 2, mira la página 1 para asegurarse de que el color del pelaje del gato no cambió. Mira la página 3 para asegurarse de que el movimiento sea fluido. En lugar de trabajar solo con píxeles, diminutos puntos, la IA trabaja con parches que representan el espacio —una parte de la imagen— y el tiempo: cómo se mueve esa parte en unos segundos. Crea toda la línea de tiempo a la vez, para que la historia tenga sentido de principio a fin.
3:29 · Cómo aprende la IA cómo es un gato
Quizá te preguntes: ¿cómo sabe cómo es un gato? La IA ha visto miles de millones de imágenes etiquetadas en internet, por ejemplo, una foto de un gato etiquetada «gato». No memoriza fotos. En cambio, aprende recetas matemáticas de las cosas. No guarda un JPEG de un gato. Guarda el concepto: los gatos suelen tener dos orejas puntiagudas, bigotes y pelaje.
3:56 · La parte más difícil: los parches de espacio-tiempo
Esta es la parte más difícil. Para hacer un video, la IA tiene que lograr un movimiento fluido y constante en el tiempo, dividiendo el video en bloques 3D de datos que contienen la imagen y el tiempo. Imagina que un video de cinco segundos es un bloque macizo de hielo claro. El frente del bloque es el inicio, el segundo 0; la profundidad del bloque es el tiempo, que llega a 5 segundos al fondo. La IA corta este enorme bloque de hielo en miles de pequeños cubitos de hielo. Cada cubito, un parche de espacio-tiempo, es una pieza de rompecabezas que se mueve. Sabe exactamente cómo es una pequeña parte de la imagen y cómo debe moverse durante esos pocos segundos. Por qué funciona: al encajar estos cubos en movimiento, la IA se asegura de que un personaje no cambie de ropa de repente ni desaparezca al moverse, porque el tiempo y los movimientos están integrados en el bloque.
4:50 · Resumen: el escultor y el dibujante de libros animados
La IA de imágenes es como un escultor que va tallando un bloque de estática para revelar una imagen. La IA de video es como un dibujante de libros animados que hace todas las páginas a la vez para que la historia fluya.
