万相Wan3.0-Video模型解析:All-in-One全能参考视频生成

阿里云万相Wan3.0-Video模型8月6日上架百炼平台,定位为All-in-One全能参考视频生成模型。和上一代相比,它把多种视频生成能力统一到同一个模型中,开发者不用再为不同任务切换不同模型。

万相Wan3.0模型解析

统一能力

Wan3.0在一个模型内支持三种生成方式:

  • 文生视频:输入文本描述,生成视频。
  • 图生视频:输入首帧图片或首尾帧图片,生成过渡视频。
  • 参考生视频:输入参考图片和文本描述,生成保持参考元素的视频。

输出分辨率覆盖480P到1080P,单次最长30秒。配套了智能时长推荐和视频延伸工具——模型根据提示词内容自动建议合适的视频时长,生成后可以继续延长。

文档输入能力

Wan3.0首次支持文档格式输入,包括doc、xls、ppt、pdf、md。模型能解析文档中的文字、图片和结构信息,将其转化为视频画面。比如把一份产品介绍PPT转成产品宣传片,或者把一份数据报表转成动态数据可视化视频。

商用场景

官方列出了四个主要商用方向:影视制作(预告片、特效镜头)、广告投放(产品展示视频)、UI设计(交互动效演示)和文旅宣传(景点介绍视频)。API已开放调用,按分辨率和时长计费。