Wan 3.0 视频生成模型

Wan 3.0 是阿里巴巴万相系列的新一代 AI 视频生成模型,支持文生视频、图生视频及多模态参考生成,单次可生成最长 30 秒的视频,并原生生成人声台词、背景音乐和环境音效。从商品展示、TikTok 创意素材到短剧片段与品牌故事,让你的创意拥有更完整的声画表达。现在即可在 Oumomo 免费体验。

输入文字或@参考内容,自由组合图、文、音、视频多元素,定义精彩互动。例如:@图片1中的人物手持@图片2的商品模仿@视频1的动作,音色参考@音频1(图片及视频素材请勿包含真实人物)
0 积分

Wan 3.0 核心功能

  • 最长 30 秒,让创意展开成故事 在一次生成中安排开场、动作发展和结尾,让商品演示、情节片段和品牌故事拥有连贯的叙事节奏。
  • 多模态参考,让素材成为创作起点 支持图片、视频和音频组合参考,也可依据文档或公开网页内容生成视频。把角色形象、场景氛围和内容资料转化为更清晰的创作方向。
  • 原生声画生成,让场景听起来也有生命力 同步生成画面、台词、背景音乐和环境音效,让人物交流、产品使用和故事场景拥有声音表达。
  • 视频编辑与延长,让好创意继续生长 根据提示词调整画面元素、风格、光线或台词,也可延长已有视频,为创意迭代和故事续写提供更多空间。

如何在 Oumomo 使用 Wan 3.0

可以从文字描述开始,也可以加入图片、视频、音频或其他参考素材,让创意方向更明确。

1. 描述主体、场景、动作和镜头

写清你希望出现的主体、场景、动作和镜头方向。制作商品或品牌内容时,还可以补充开场、动作发展和结尾,让一次生成拥有更完整的叙事节奏。

2. 添加参考素材并优化提示词

按需上传图片、视频或音频参考,也可以依据文档或公开网页内容明确创作方向。再使用提示词优化,把角色形象、场景氛围和内容资料整理成更清晰的生成指令。

3. 生成后按需编辑或延长

生成后检查画面、台词、背景音乐和环境音效。需要调整时,描述要修改的画面元素、风格、光线或台词;也可以说明接下来发生的情节,延长已有视频。

Wan 3.0 常见问题

Wan 3.0 将单次生成时长扩展至最长 30 秒,新增文档输入,并进一步提升人物真实感及参考生成中的角色、道具、空间和风格一致性。

可以。你可以从文字描述开始,写清主体、场景、动作和镜头方向;也可以提供图片或其他参考素材,让创意方向更明确。

模型支持文档和公开网页输入,可用于把产品介绍、演示资料等内容转化为视频创作参考。具体入口以 Oumomo 当前开放的功能为准。

模型支持视频编辑与延长。你可以描述需要调整的内容,或说明接下来发生的情节,继续探索新的版本。可用功能以 Oumomo 实际配置为准。

可以作为广告创作素材。发布前应检查商品外观、人物动作、文字、声音及宣传表述,并按 TikTok 的广告要求审核;模型生成结果不代表平台审核承诺。

Wan 3.0 视频生成模型|阿里万相|Oumomo