> ## Documentation Index
> Fetch the complete documentation index at: https://novita.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# ¿Qué es el autoencoder variacional VAE?

### Introducción a los autoencoders

Los autoencoders son una clase de redes neuronales que se utilizan principalmente para el aprendizaje no supervisado y la reducción de dimensionalidad. La idea fundamental detrás de los autoencoders es codificar los datos de entrada en una representación de menor dimensión y luego decodificarlos de vuelta a los datos originales, con el objetivo de minimizar el error de reconstrucción. La arquitectura básica de un autoencoder consta de dos componentes principales: el encoder y el decoder.

* **Encoder**: El encoder es responsable de transformar los datos de entrada en una representación comprimida o latente. Normalmente consta de una o más capas de neuronas que reducen progresivamente las dimensiones de la entrada.

* **Decoder**: El decoder, por otro lado, toma la representación comprimida producida por el encoder e intenta reconstruir los datos de entrada originales. Al igual que el encoder, a menudo consta de una o más capas, pero en orden inverso, aumentando gradualmente las dimensiones.

<Frame>
  <img height="404" src="https://next-app-static.s3.ap-southeast-1.amazonaws.com/get-started/misc_01.png" />
</Frame>

### Descripción general de los autoencoders variacionales (VAEs)

Los autoencoders variacionales (VAEs) abordan algunas de las limitaciones de los autoencoders tradicionales al introducir un enfoque probabilístico para la codificación y la decodificación. La motivación detrás de los VAEs reside en su capacidad para generar nuevas muestras de datos al muestrear desde una distribución aprendida en el espacio latente, en lugar de hacerlo desde un vector latente fijo como ocurría con los autoencoders convencionales. Esto los hace adecuados para tareas generativas.

* **Naturaleza probabilística**: A diferencia de los autoencoders deterministas, los VAEs modelan el espacio latente como una distribución de probabilidad. Esto produce una función de distribución de probabilidad sobre las codificaciones de entrada en lugar de solo un único vector fijo, lo que permite una representación más matizada de la incertidumbre en los datos. Luego, el decoder muestrea desde esta distribución de probabilidad.

* **Rol del espacio latente**: El espacio latente en los VAEs sirve como una representación continua y estructurada de los datos de entrada. Dado que es continuo por diseño, esto permite una interpolación sencilla. Cada punto del espacio latente corresponde a una salida potencial, lo que posibilita transiciones suaves entre distintos puntos de datos y garantiza que los puntos cercanos en el espacio latente conduzcan a generaciones similares.

El concepto puede explicarse mediante un ejemplo sencillo, como se presenta a continuación. Los encoders dentro de una red neuronal tienen la tarea de adquirir una representación de las imágenes de entrada en forma de vector. Este vector encapsula diversas características, como la sonrisa de una persona, el color del cabello, el género, la edad, etc., representadas como un vector similar a \[0.4, 0.03, 0.032, …]. En esta ilustración, el enfoque se reduce a una única representación latente, específicamente el atributo de una "sonrisa".

Autoencoders vs VAEs - Sciforce Medium. En el contexto de los autoencoders convencionales (AE), la característica de la sonrisa se encapsula como un valor fijo y determinista. En cambio, los autoencoders variacionales (VAEs) están diseñados deliberadamente para encapsular esta característica como una distribución probabilística. Esta elección de diseño facilita la introducción de variabilidad en las imágenes generadas al permitir el muestreo de valores desde la distribución de probabilidad especificada.

<Frame>
  <img height="500" src="https://next-app-static.s3.ap-southeast-1.amazonaws.com/get-started/misc_02.png" />
</Frame>

En resumen, los VAEs van más allá de la mera reconstrucción de datos; generan nuevas muestras y proporcionan un marco probabilístico para comprender las representaciones latentes. La inclusión de elementos probabilísticos en la arquitectura del modelo distingue a los VAEs de los autoencoders tradicionales. En comparación con los autoencoders tradicionales, los VAEs ofrecen una comprensión más rica de la distribución de los datos, lo que los hace especialmente potentes para tareas generativas.
