Back to News

Alibaba launches Wan3.0 video model with 30-second generation and document input

#alibaba#wan3.0#video-generation#ai-model

Alibaba officially launched its video generation model Wan3.0 on August 24, 2026, featuring upgrades in generation length, document input, and realism. The model can generate 30-second videos in a single run and, for the first time, supports input from document formats such as doc, xls, ppt, pdf, and md. Early enterprise users report consistent feedback describing the model as stable, realistic, and textured, with applications in short dramas, film, advertising, and cultural tourism.

Coverage timeline

  1. 量子位量子位

    阿里视频大模型Wan3.0正式上线,行业评价“稳定、真实、有质感” 量子位的朋友们 2026-08-24 13:09:27 来源: 量子位 8月24日,阿里巴巴视频生成大模型Wan3.0正式上线。 8月24日,阿里巴巴视频生成大模型Wan3.0正式上线。该模型在生成时长、万能创作、全能参考以及真实世界还原等维度全面升级,单次可生成30秒视频,并首次支持doc、xls、ppt、pdf、md等文档格式输入,力求准确还原真实世界。公测以来,见证Wan模型家族历次更新的创作者表示,Wan3.0是“最惊喜的一次”。从企业用户体验来看,Wan3.0收到的反馈高度一致,“稳定、真实、有质感”是被反复提到的三个关键词。 Wan3.0在角色、道具、声音、空间关系、风格等细粒度维度均可稳定保持,这对追求生产力的企业用户而言尤为关键。比如这段高速追车戏中,Wan3.0能够读懂参考素材,处理长时序叙事。30 秒内,人物、车辆、环境高度一致,上车、追逐、高速特技直至爆炸,全程连贯输出,无需反复抽卡、来回调试。 (视频来源:LibTV) 真实是 Wan3.0 告别“AI 感”的分水岭。有企业用户提到,Wan3.0补上了AI视频长期缺失的一环——真人质感的稳定输出。为告别AI人物的油腻感与千篇一律,Wan3.0力求“千人千面”,更敏锐地刻画五官与皮肤细节,人物情绪表达自然克制,微表情与肢体动作彼此联动。比如这一段人物视频中,女孩的眼球反射、毛发细节、白纱运动与水面光泽四种难还原的物理属性在同一镜头内出现,Wan3.0全程守住冷灰蓝调,皮肤也没有塑料化。 (视频来源:Flova AI) 有质感意味着Wan3.0具备镜头美学,既注重色彩的和谐搭配,也保持信息的流畅表达。有用户提到,Wan3.0 能很好地理解并融合风格化参考图,快速适配设定的视觉风格。比如这支风格化短片,融合了浓郁的红色调与蒸汽朋克机械美学。层叠裙摆的厚重感、金属齿轮的冷硬感、烛光的暖调漫反射……不同材质在统一色调下,各自保持物理特性,营造出舞台剧般的纵深感。 (视频来源:三代科技) 公测期间,Wan3.0已经进入企业生产流程,参与短剧与影视业、广告业的规模化出片,融入创作者平台工作流,并辅助文旅传播和MV的制作。有用户点评,Wan3.0的核心价值不在于单帧视觉冲击力,而在于稳定、连续、可落地的内容生产能力,对于短剧作者来说是“性价比

  2. Techmeme

    Reuters : Alibaba launches Wan3.0, a video generation model that can generate 30-second videos from documents, spreadsheets, slides, and web pages — Alibaba (9988.HK) officially rolled out its latest AI video generation-model Wan3. on Monday with enhanced capabilities after the Chinese internet giant launched …