阿里云万相3.0视频生成模型介绍:支持参考、编辑、复刻、驱动等创作功能,最长支持30秒视频生成

简介: 本文解析了阿里云通义万相新一代全能视频生成大模型Wan3.0,它支持文生视频、多素材参考、文档直接转视频等能力,最长可生成30秒带原生音频的1080P高清视频。文章覆盖核心功能、分分辨率计费标准、API接入教程,同步介绍新用户10秒免费额度与当前限时7折活动,是短剧、广告、文旅等场景实现高效AI视频创作的实用选型参考。

阿里云通义万相团队正式推出新一代视频生成大模型Wan3.0(万相3.0),这是通义万相系列自1.0以来历经8个版本迭代后打造的全能型参考视频生成模型,以“稳定、真实、有质感”为核心标签,将单次视频生成上限提升至30秒,首次在行业内实现办公文档直接转视频的能力,覆盖480P到1080P全分辨率输出,已在短剧影视、广告营销、文旅宣传等多个领域落地规模化应用。本文将从模型定位、核心能力、价格体系、适用场景、使用教程、免费额度、最新活动七个维度进行全面解析,帮你快速掌握这款全能视频生成模型的全部信息。

Wan3.0重磅发布.png

一、阿里云万相3.0模型简介

万相3.0(Wan3.0)是阿里云百炼平台推出的全能参考视频生成模型(All-in-One),统一支持文生视频、图生视频(首帧/首尾帧)和参考生视频等多种创作模式。该模型支持文本、图像、视频、音频等多模态输入,单次生成时长最长可达30秒,输出帧率为30fps,并原生支持输出台词、背景音乐(BGM)和音效。在模型版本上,万相3.0提供标准版wan3.0-video和高速版wan3.0-video-prime两种选择,高速版在能力对齐标准版的同时显著提升了端到端生成速度。

二、阿里云万相3.0模型能力

万相3.0作为All-in-One模型,无需切换模型名称即可覆盖多种任务类型,模型根据input.media中的type字段和提示词意图自动路由。

1. 全能参考能力

万相3.0支持最多20个多模态素材参考,涵盖图片、视频、音频、文档和网页五种类型。在提示词中可使用“图1”“视频1”“音频1”等指代input.media数组中对应顺序的素材,且图片、视频、音频分别计数,互不冲突。具体参考能力包括:

  • 角色/物品参考:传入角色或物品图片(reference_image),保持外观一致性生成视频,最多支持10张参考图。
  • 运镜/动作复刻:传入参考视频(reference_video),复刻其运镜方式或动作编排,最多5段,总时长不超过15秒。
  • 音频驱动:传入音乐或语音(reference_audio),生成与节拍/语调同步的舞蹈或口型动画,最多5段,总时长不超过15秒。
  • 组合参考:支持图片+视频、图片+音频、视频+音频、图片+视频+音频等多种素材任意组合。
  • 文件/网页生视频:通过file类型传入docx、pptx、xlsx等文档,或通过link类型传入公开网页链接,模型自动解析内容生成视频。

2. 首尾帧控制能力

万相3.0支持像素级还原参考画面的首尾帧控制功能:

  • 首帧生视频:通过first_frame类型传入一张图片作为视频第一帧,模型自动生成后续运动内容。
  • 首尾帧生视频:同时传入first_framelast_frame,严格指定视频的第一帧和最后一帧,模型自动生成中间过渡运动,适用于需要精准控制起止画面的场景。

需注意,reference_xx/file/link类型与first_frame/last_frame类型互斥,不可在同一请求中混用。

3. 视频编辑与延长

  • 视频编辑:通过reference_video传入待编辑视频,结合包含编辑意图(如“去掉”“替换”“改成”)的提示词,实现增删改元素、风格转换、光线编辑、台词编辑等功能。
  • 视频延长:通过reference_video传入原始视频,结合包含延长意图(如“延长”“续写”“向前/向后延长”)的提示词,支持向前、向后或双向延长视频内容。

4. 有声视频生成

万相3.0原生支持有声视频输出,默认开启音频生成(audio=true),可自动生成同步的人声台词、环境音效和背景音乐,无需后期配音;也可通过设置audio=false关闭音轨,开关声音价格相同。

三、阿里云万相3.0模型价格

Wan3.0采用按生成视频时长与分辨率计费的模式,任务执行失败不计费,不会产生额外扣费开销,不同地域的定价略有差异:

Wan3.0 视频生成(480P),标注"入门首选",主打"一个镜头,容纳完整世界",活动价 0.21 元/秒,原价 0.3 元/秒,限时 7 折。其优势体现在三方面:超值——一次体验上手,轻松走向规模创作;创作——不止生成一段视频,而是导演一个世界;优势——适合快速创意验证,兼顾画质与生成效率。

Wan3.0 视频生成(720P),同样主打"一个镜头,容纳完整世界",活动价 0.42 元/秒,原价 0.6 元/秒,限时 7 折,具备超值、创作、优势三大相同特性,适合对画质有更高要求的创作者。

Wan3.0 视频生成(1080P),活动价 0.84 元/秒,原价 1.2 元/秒,限时 7 折,提供电影级输出品质,同样具备超值、创作、优势三大特性,适合追求极致画质的专业创作场景。

四、阿里云万相3.0模型适用场景解析

基于万相3.0的全能参考和多模态输入特性,其适用场景包括:

  • 广告营销与产品展示:通过PPT/Excel文件直接生成产品广告视频,或上传产品图生成模特试色、佩戴展示等电商素材视频。
  • 影视创作与短剧制作:利用首尾帧控制实现精准分镜衔接,通过多镜头叙事提示词生成最长30秒的连续剧情片段,原生有声输出降低后期配音成本。
  • 内容二创与风格迁移:通过视频编辑功能将现有视频转换为黏土风、水墨风等特定美学风格,或通过参考图实现跨素材的风格统一。
  • 教育与知识科普:传入百科网页链接或教学文档,自动解析内容生成动画讲解视频。
  • 数字人与口播视频:结合音频参考和角色图片参考,生成口型同步、神态自然的数字人播报视频。
  • 数据可视化:基于Excel表格数据自动生成带旁白、BGM和动态图表的数据汇报视频。

五、阿里云万相3.0使用教程

以下介绍通过DashScope Python SDK调用万相3.0的示例代码。使用前需确保DashScope Python SDK版本不低于1.26.2.1。

1. 文生视频示例

仅通过提示词生成视频,不传入任何媒体文件:

import os
from http import HTTPStatus
from dashscope import VideoSynthesis
import dashscope

dashscope.base_http_api_url = 'https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1'
api_key = os.getenv("DASHSCOPE_API_KEY", "YOUR_API_KEY")

rsp = VideoSynthesis.call(
    api_key=api_key,
    model='wan3.0-video',
    prompt='一只小猫在月光下的屋顶上奔跑,城市的霓虹灯在远处闪烁,电影级画质,流畅运镜。',
    resolution="480P",
    ratio="adaptive",
    duration=5,
    prompt_extend=True)

if rsp.status_code == HTTPStatus.OK:
    print("video_url:", rsp.output.video_url)
else:
    print('Failed, status_code: %s, code: %s, message: %s' % (rsp.status_code, rsp.code, rsp.message))

2. 首帧生视频示例

传入首帧图片,严格指定视频第一帧:

rsp = VideoSynthesis.call(
    api_key=api_key,
    model='wan3.0-video',
    prompt='一只猫在草地上奔跑',
    media=[{
   "type": "first_frame", "url": "https://cdn.translate.alibaba.com/r/wanx-demo-1.png"}],
    resolution="720P",
    ratio="adaptive",
    duration=5)

3. 全模态参考生视频示例

传入多张参考图片和参考视频,在提示词中通过“图1”“视频1”指代:

rsp = VideoSynthesis.call(
    api_key=api_key,
    model='wan3.0-video',
    prompt='视频1抱着图3,在图4的椅子上弹奏一支舒缓的乡村民谣,并说道:"今天的阳光真好。"图1手中拿着图2,路过视频1,把手中的图2放到视频1旁边的桌子上,并说道:"真好听,能不能再唱一遍"。',
    media=[
        {
   "type": "reference_image", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260408/sjuytr/wan-r2v-object-girl.jpg"},
        {
   "type": "reference_video", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qigswt/wan-r2v-role2.mp4"},
        {
   "type": "reference_image", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/rtjeqf/wan-r2v-object3.png"},
        {
   "type": "reference_image", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qpzxps/wan-r2v-object4.png"},
        {
   "type": "reference_image", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/wfjikw/wan-r2v-backgroud5.png"}
    ],
    resolution="720P",
    ratio="adaptive",
    duration=5)

关键注意事项

  • 调用时需确保模型、Endpoint URL和API Key均属于同一地域,跨地域调用将失败。
  • HTTP API采用异步模式,SDK封装了异步流程支持同步调用(VideoSynthesis.call)和异步调用(VideoSynthesis.async_call + fetch + wait)两种方式。
  • 生成视频URL有效期为24小时,请及时保存至永久存储。
  • {WorkspaceId}需替换为真实的业务空间ID。

六、阿里云万相3.0免费额度

阿里云百炼为所有新用户提供免费体验额度,大幅降低入门门槛:

  • 免费额度标准:首次开通百炼的用户,可免费领取Wan3.0的10秒免费生成额度,可用于体验文生视频、图生视频等基础功能;
  • 适用范围:免费额度可用于抵扣按量付费的调用费用,适用于华北2(北京)地域的实时推理调用;
  • 额度消耗:免费额度优先于按量付费扣费,额度耗尽后会自动从账户余额扣费,建议开启“免费额度用完即停”功能,避免意外产生费用。

此外,用户也可以通过Token Plan订阅计划使用Wan3.0,订阅后获得的Credits可统一抵扣视频生成模型的调用费用,适合高频使用的场景。详情可参考:https://www.aliyun.com/benefit/scene/tokenplan

39与139.png

七、阿里云万相3.0最新活动

截至目前,Wan3.0正在进行限时7折优惠活动,具体优惠内容如下:

限时7折API调用优惠

  • 活动时间:2026年8月24日至9月23日
  • 优惠范围:阿里云百炼和千问AI平台的Wan3.0标准版API调用
  • 折后价格:480P 0.21元/秒、720P 0.42元/秒、1080P 0.84元/秒
  • 适用场景:所有通过API调用Wan3.0生成视频的用户,权益自动生效,无需手动领取。

活动详情可参考:https://www.aliyun.com/benefit/scene/wan

新一代视频生成模型7折.png

节省计划优惠
用户还可以购买AI通用型节省计划,覆盖Wan3.0在内的全模型通兑,最低可享4.5折优惠,适合长期高频使用的企业和团队,可进一步降低视频生成的成本。

全模型通享低至4.5折.png

此外,Wan3.0已在阿里云百炼、万相官网、万镜一刻、千问创作PC端、千问APP、堆友、IF STUDIO等多个平台开放体验,普通用户可以直接通过网页端零门槛上手生成视频,开发者可以通过API将视频生成能力集成到自己的生产管线中。

更多限时优惠、折扣活动或免费体验额度,请以百炼控制台和阿里云官网活动页面实时信息为准。

相关文章
|
3天前
|
人工智能 自然语言处理 安全
阿里云AI数智鉴密:AI 生成内容如何拿到一张"防篡改的身份证"
隐形水印 + C2PA签名:让AI生成内容“持证上岗”。
1102 0
|
12天前
|
人工智能 自然语言处理 安全
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
本文聚焦阿里云2026年推出的三款自研AI办公产品,清晰拆解千问办公、Qoder Teams、Qoder CN的差异化定位与能力边界:千问办公主打职场全场景提效,支持自然语言指令一键完成PPT生成、数据分析等高频办公任务;Qoder Teams面向程序员团队,深度整合AI代码生成、团队协同与企业知识库能力;Qoder CN则专为金融、政务等强合规场景打造,实现数据不出境与VPC私有化部署。文章同步给出分场景选型指南与最新活动定价,帮助不同类型的企业按需组合产品,实现业务岗、研发岗与强合规场景的AI能力全覆盖。
3685 3
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
|
23天前
|
人工智能 缓存 前端开发
DeepSeek Harness 首发实测 + 入门教程,夯爆了!梁神我错了
DeepSeek Harness + DeepSeek V4 Pro 项目实战保姆级教程!手把手带你从零安装开源 AI 编程工具,开发架构图、知识讲解网站、3D 网页游戏、全栈 AI 应用 4 个项目,覆盖运行模式选择、插件安装与开发,看看能不能对标 Claude。
13472 93
DeepSeek Harness 首发实测 + 入门教程,夯爆了!梁神我错了
|
17天前
|
Web App开发 人工智能 API
16 个超火的 DeepSeek Harness 插件,大肥鱼已经落后 N 个版本了。。。
DeepSeek Harness 精选插件推荐合集,从图片识别、浏览器操控、多 Agent 协作到手机远程控制,一口气带你看完 DSH 社区热门的十几个插件,覆盖技能扩展、UI 界面增强、整活玩法三大类,让你的鲸鱼变得更强。
1955 5
|
9天前
|
人工智能 监控 测试技术
Qwen3.8-Flash 来了,100万上下文、Agent、Coding 都加强了
8月26日,通义千问发布Qwen3.8-Flash-Next:125B参数、每Token仅激活6B,原生支持26万Token、可扩展至100万上下文;Coding、Agent与工具调用能力显著增强,面向真实软件工程任务,推动大模型从“回答问题”迈向“完成工作”。
|
12天前
|
人工智能 Linux iOS开发
Ollama使用教程:Ollama官网下载、Ollama本地部署大模型(2026最新)
Ollama 是一款免费开源的本地大模型运行工具,支持在 Windows/macOS/Linux 上离线运行 Qwen、DeepSeek、Llama 等主流开源模型,数据不出本机、隐私安全。提供 OpenAI 兼容 API,命令行一键拉取/运行/管理模型,无需联网,无调用限制,是开发者与 AI 爱好者部署本地 AI 助手的理想选择。(239 字)
|
18天前
|
人工智能 Java BI
【AI】DeepSeek Harness 安装、运行、管理插件
本文介绍了如何运行DeepSeek开源的Agent框架DeepSeek Harness(dsh)。主要内容包括:使用nvm安装适配的Node版本;通过代理加速克隆GitHub源码;使用pnpm安装依赖并启动项目;配置DeepSeek API Token;安装扩展功能的插件。该框架自带Web界面,支持模型适配、文件编辑等插件化功能
2197 1

热门文章

最新文章