Alibaba ha lanzado en versión beta su modelo de generación de videos, Wan3.0, que permite crear videos de hasta 30 segundos a partir de texto, imágenes y documentos. Este nuevo modelo duplica la duración máxima de su predecesor, Wan2.5, y ofrece recomendaciones sobre la mejor longitud de video según las indicaciones del usuario.
Wan3.0 puede procesar simultáneamente texto, imágenes, video y audio, permitiendo que un solo comando incluya hasta diez imágenes, cinco videos y cinco clips de audio. Además, admite páginas web y documentos como archivos PDF o presentaciones de PowerPoint, transformando datos estáticos en videos dinámicos. A pesar de los avances, se reconoce que los videos generados por inteligencia artificial pueden presentar problemas visuales, especialmente en rostros e interfaces de usuario.
Alibaba ha diseñado Wan3.0 para diversas aplicaciones, como la producción cinematográfica y la creación de contenido para redes sociales, con el objetivo de ayudar a las empresas a generar videos de marketing y formación. Este lanzamiento se produce en un contexto de aumento en la inversión de Alibaba en inteligencia artificial, tras anunciar la mayor venta de acciones de una empresa cotizada en Hong Kong para financiar su impulso en este sector.