Alibaba opens Wan3.0 beta with 30-second video generation and multimodal reference inputs · cho.sh
Alibaba opens Wan3.0 beta with 30-second video generation and multimodal reference inputs
AI video model releases
Alibaba opens Wan3.0 beta with 30-second video generation and multimodal reference inputs
Alibaba has started a public beta for Wan3.0, with testing applications available through Alibaba Cloud Model Studio and Qwen Cloud.
Wan3.0 generates clips up to 30 seconds, twice the 15-second maximum cited for its predecessor Wan2.7-Video, and includes prompt-based duration recommendations and video extension tools.
The model accepts simultaneous text, image, video, and audio references, plus web pages, PDFs, and PowerPoint files, to turn static material into video.
Alibaba says Wan3.0 maintains visual continuity across faces, character and product details, spatial layouts, software interfaces, motion graphics, and audio, while producing multilingual voices and synchronized facial micro-expressions.
Alibaba positions Wan3.0 for filmmaking, short dramas, social content, marketing and education videos, plus simulation-video generation for self-driving cars and robotics training.