Diffusion Model

IA & ML · Profundo

Una arquitectura de IA generativa que crea imagenes, video o audio aprendiendo a revertir un proceso de adicion de ruido, partiendo de ruido puro y eliminando ruido iterativamente para producir una salida coherente. Los modelos de difusion potencian los generadores de imagenes lideres (Stable Diffusion, DALL-E 3, Midjourney) y generadores de video (Sora). Las variantes clave incluyen difusion latente (operando en espacio comprimido) y transformers de difusion (DiT).

Términos relacionados