Cuando un modelo de IA se entrena para crear imágenes a partir de texto, utiliza un enorme conjunto de datos de imágenes y sus correspondientes pies de foto. El modelo se entrena mostrándole los pies de foto y haciendo que intente recrear las imágenes asociadas a cada una con la mayor fidelidad posible. El modelo aprende tanto conceptos generales presentes en millones de imágenes, como la apariencia humana, como detalles más específicos, como texturas, entornos, poses y composiciones, que son más fácilmente identificables.
Cargando contenido...
