LAION-BVD: un corpus abierto de 10 millones de horas de vídeo para entrenar modelos multimodales
El proyecto LAION ha presentado LAION-BVD, un conjunto de datos de vídeo a gran escala y código abierto destinado al entrenamiento de modelos multimodales. A partir de 1.300 millones de URLs recogidas de Common Crawl, el equipo descargó 80 millones de vídeos con una duración total de 10 millones de
