文生视频用一个模型,图生视频换一个,参考生视频再换一个。做视频生成应用的开发者,多半被三套接口的维护折腾得够呛。8 月 6 日,阿里云百炼平台上架 万相 Wan3.0-Video,专门来收这个摊子:定位 All-in-One 全能参考视频生成,多种生成能力并进同一个模型。

一个模型,三种生成方式全接
单模型里装了三种生成方式。文生视频,文本描述丢进去直接出片,是最基础的用法。图生视频,喂首帧或首尾帧图片,中间过渡画面由模型补齐,让静态图动起来归它管。参考生视频,参考图配文本描述,生成时保住参考元素,人物形象、产品外观这类必须长得对的内容,走这条路径。
输出规格:分辨率 480P 到 1080P,单次最长 30 秒。另配了两个顺手的小工具。智能时长推荐,模型看提示词内容自动建议合适的时长,省得自己拍脑袋猜。视频延伸,生成完还能续,短视频想拉成长内容有路可走。
真正拉开身位的,是文档输入
doc、xls 和 ppt 这些常用格式通吃。pdf、md 也在支持之列。模型解析文档里的文字、图片和结构,再转成视频画面。
摆两个场景感受一下。一份产品介绍 PPT,直接转成产品宣传片,市场部的物料成本立刻下来一截。一份数据报表,变成动态可视化视频,汇报和路演的观感完全是另一个档次。文档是企业里存量最大的内容资产,能被低成本视频化。这个能力对 B 端的吸引力,可能盖过任何画质升级。
往哪儿用,怎么接
官方点名四个主攻方向:影视制作做预告片和特效镜头,广告投放出产品展示视频,UI 设计演示交互动效,文旅宣传做景点介绍视频。API 已开放调用,按分辨率和时长计费。
对开发者来说,All-in-One 的实际价值落在维护成本上:一套接口适配三种任务,应用架构里能省下不少胶水代码。至于生成质量跟专用模型比有没有差距,公测期间自己跑几组对照,心里就有数了。