阿里巴巴发布开源视频编辑全功能模型Wan2.1-VACE,视频创作迎来"全能选手"!

简介: 阿里巴巴发布的开源模型Wan2.1-VACE,作为“万相2.1”系列成员,是业内首个视频生成与编辑统一解决方案。该多合一AI模型支持文本、图像和视频的多模态输入,提供视频生成、局部编辑、画面延展等功能,大幅提升创作效率。借助创新技术如“视频条件单元”和“上下文适配”,Wan2.1-VACE可广泛应用于短视频制作、广告营销等领域。模型已上线Hugging Face等平台,免费下载使用,助力AI普惠。


Swipe for English >>>

多合一AI模型革新视频创作行业

阿里巴巴集团发布最新开源视频生成与编辑模型 Wan2.1-VACE(Video All-in-one Creation and Editing)。此创新工具整合多项视频处理功能于单一模型中,可简化视频创作流程,提升效率与生产力。

作为阿里巴巴视频生成大模型“万相2.1”(Wan2.1)系列的一员,Wan2.1-VACE是业内首个提供视频生成与编辑统一解决方案的开源模型。该模型支持基于文本、图像和视频的多模态输入进行视频生成,同时为创作者提供全面的视频编辑功能,包括参考图像或参考帧视频生成、视频转绘、视频局部编辑、画面和时长延展等,这些功能可灵活组合以激发创意。

借助这款先进工具,用户可以根据图像样本生成包含特定主体的视频,为静态图像添加自然运动效果使其“活起来”,同时还可使用姿态迁移、运动控制、深度控制和着色等高级视频重绘功能。该模型还支持对视频局部区域进行添加、修改或删除而不影响区域外的内容,并能扩展视频边界,智能填充内容以丰富视觉体验。

作为多合一AI模型,Wan2.1-VACE具有领先市场的多功能性,允许用户结合多种功能,释放创新潜力。用户可将静态图像转为视频,并通过规定运动轨迹控制物体移动;替换指定人物或物体;为角色添加动画效果并控制姿势;将竖向图像横向扩展为横版视频,同时添加新元素。

以创新技术推动AI普惠

Wan2.1-VACE采用多项创新技术,在构建和设计时充分考虑了不同视频编辑任务的需求。其统一接口“视频条件单元”(Video Condition Unit, VCU),可支持对文本、图像、视频和蒙版等多模态输入进行统一处理。此外,该模型的“上下文适配”(Context Adapter)结构,通过使用时空维度的形式化表征来注入各种任务概念,这一创新设计使其能够灵活处理各类视频合成任务。

得益于模型架构的进步,Wan2.1-VACE可广泛应用于社交媒体短视频的快速制作、广告营销的内容创作、影视后期的特效处理,以及教育培训视频的生成等领域。

训练视频基础模型需要大量计算资源和高质量训练数据,开源此模型有助于更多企业以高成本效益的方式,快速创建符合需求的高质量视觉内容,推动AI的普惠与普及。

阿里巴巴开源的Wan2.1-VACE模型提供140亿参数和13亿参数两个版本,已在Hugging Face、GitHub以及阿里云开源社区ModelScope上发布,可免费下载使用。

作为全球最早开源自研大模型的科技公司之一,阿里巴巴已于2025年2月开源了四款万相2.1系列模型,并在上个月开源了支持首尾帧视频生成的模型。截至目前,这些模型在Hugging Face和ModelScope上的下载量已超过330万次。

点击文末↓"阅读原文"立刻上百炼体验API服务👇

来源  |  Alibaba Cloud International公众号

相关文章
|
数据安全/隐私保护 开发者 异构计算
阿里巴巴开源可控视频生成框架VideoComposer!(内含体验、推理实践干货)
8月16日,时间、空间可控的视频生成模型 VideoComposer 在魔搭社区开源。
阿里巴巴开源可控视频生成框架VideoComposer!(内含体验、推理实践干货)
|
人工智能 弹性计算 API
再不玩通义 VACE 模型你就过时了!一个模型搞定所有视频任务
介绍通义的开源模型在 ecs 或 acs 场景如何一键部署和使用,如何解决不同视频生成场景的问题。
|
4月前
|
人工智能
HappyHorse上架阿里云百炼,开启AI视频创作新纪元
阿里巴巴旗下AI视频模型HappyHorse上线阿里云百炼平台,支持文生视频、图生视频、多图参考生成与编辑,具备15秒多镜头叙事、多画幅适配及1080P超清输出能力,大幅降低创作门槛,赋能全场景视频生产。
|
人工智能
HunyuanVideo:腾讯推出的开源视频生成模型,参数高达130亿
腾讯推出的开源视频生成模型HunyuanVideo,拥有130亿参数,是目前参数量最大的开源视频模型之一。该模型具备物理模拟、高文本语义还原度、动作一致性和电影级画质等特性,能生成带有背景音乐的视频,推动了视频生成技术的发展和应用。
1562 16
HunyuanVideo:腾讯推出的开源视频生成模型,参数高达130亿
|
人工智能 弹性计算 JSON
再不玩通义VACE模型你就过时了!一个模型搞定所有视频任务
阿里巴巴开源通义万相Wan2.1-VACE,业界功能最全的视频生成与编辑模型,支持文生视频、图像参考生成、视频重绘、局部编辑、背景延展等,统一模型实现多任务自由组合,轻量版本消费级显卡即可运行。
|
人工智能 自然语言处理 算法
AI智能混剪视频大模型开发方案:从文字到视频的自动化生成·优雅草卓伊凡
AI智能混剪视频大模型开发方案:从文字到视频的自动化生成·优雅草卓伊凡
1708 0
AI智能混剪视频大模型开发方案:从文字到视频的自动化生成·优雅草卓伊凡
|
编解码 人工智能
通义万相Wan2.1-VACE开源!业内首个视频编辑统一模型!附推理教程
通义万相Wan2.1-VACE开源!业内首个视频编辑统一模型!附推理教程
2936 7
|
机器学习/深度学习 人工智能 编解码
阿里开源AI视频生成大模型 Wan2.1:14B性能超越Sora、Luma等模型,一键生成复杂运动视频
Wan2.1是阿里云开源的一款AI视频生成大模型,支持文生视频和图生视频任务,具备强大的视觉生成能力,性能超越Sora、Luma等国内外模型。
8722 2
阿里开源AI视频生成大模型 Wan2.1:14B性能超越Sora、Luma等模型,一键生成复杂运动视频

热门文章

最新文章