LAION ha lanzado el Big Video Dataset (BVD), un conjunto de datos de video abierto que abarca un impresionante total de 10 millones de horas de metraje, extraído de 1.3 mil millones de URLs de video. Este proyecto incluye 80 millones de videos descargados, de los cuales se generaron 55 millones de clips con descripciones automáticas de video y audio, además de 300 millones de imágenes fijas.
La mayoría de los videos provienen de YouTube y están en inglés. Según el estudio, los modelos entrenados con el BVD superan en hasta 2.1 puntos porcentuales a otros modelos similares que utilizan InternVid en pruebas de video a texto. Este avance se logra al combinar video, audio y texto para aprender qué contenido visual corresponde a ciertas descripciones o sonidos.
LAION ha puesto este conjunto de datos a disposición exclusivamente para fines de investigación y solicita a los usuarios que respeten los derechos de los creadores de contenido original. El conjunto de datos y el código son accesibles de forma gratuita, lo que se justifica legalmente por un fallo del Tribunal Regional de Hamburgo en 2024 que permitió la recopilación de contenido protegido por derechos de autor para investigación no comercial.