阿里云云剪辑最佳实践-批量混剪去重策略

简介: 背景进入5G时代,越来越多的商家选择短视频平台做营销推广,将广告制作成短视频投放在多个KOL或营销号。由于各大短视频平台有去重机制(防止视频盗用),内容相同的营销视频会被做屏蔽处理,这就要求投放在不同账号的视频,在内容、结构上要有差别。之前写过一些实践案例,帮大家搭建自己的混剪服务,这回我们主要来讲去重策略,帮助大家批量生产出有效的不重复的短视频。阿里云智能媒体服务IMS(Intelligent 

背景

进入5G时代,越来越多的商家选择短视频平台做营销推广,将广告制作成短视频投放在多个KOL或营销号。由于各大短视频平台有去重机制(防止视频盗用),内容相同的营销视频会被做屏蔽处理,这就要求投放在不同账号的视频,在内容、结构上要有差别。

之前写过一些实践案例,帮大家搭建自己的混剪服务,这回我们主要来讲去重策略,帮助大家批量生产出有效的不重复的短视频。

阿里云智能媒体服务IMS(Intelligent Media Services)是2021年5月份正式商业化的产品,其中的云剪辑功能,客户可以通过提交剪辑需要的数据结构Timeline,对云端的音视频内容进行二次剪辑生产。本文从案例入手,文中的视频内容都是通过提交剪辑合成任务生成的。文中不涉及代码,所有成片都是通过最佳实践跑出来的。

目标读者

有短视频批量混剪的商家,或批量混剪工具的产品、技术同学。

相关概念

时间线Timeline

和iMovie、Premiere一样,一次剪辑会包含多个轨道以及相应素材的位置、时长等信息,IMS使用Timeline来描述这些信息。用户组装好Timeline,提交剪辑合成作业,即可生产出视频了。

这是一个“多段视频拼接+Logo+文案转语音并生成字幕+背景音乐”的Timeline,Json格式,符合剪辑和开发同学的理解。timeline示例可以看到Timeline里只需描述视频顺序即可,IMS在合成时会获取素材时长,自动推测视频在成片中的位置。

方案实施

批量混剪,就是使用有限个的素材,通过不同的组合,添加不同的转场、特效、字幕、音乐,最终合成出多个不同的成片视频。这是我本次用到的素材,是我在附近盒马拍的商品视频,每个素材视频都不长。

我先简单合一批视频出来,这是我把10个成片拼到了一个视频上来看。

每个视频的剪辑策略很简单,选20个素材,每次随机挑7~8个,随机排序,截取相应的秒数,前后拼接起来:

从效果看,10个视频的内容重复度还是比较高,这里的主要原因是素材少。素材准备是剪辑中非常重要的阶段,一批好的素材能为后续的视频生产提效很多,批量混剪也一样,准备的素材越多,能得到越多的组合,从而能更大程度上去重。

批量混剪中用到的素材时长都很短,一般一个镜头只需要3~5s,在拍摄过程中多拍一些素材并不是难事。同时,同一个物品尽量能从不同角度、不同场景中多拍摄几段素材,同样能达到更高的去重度。如果是人物,尽可能选不同动作多拍一些镜头。

更多的素材能保证更好的去重度,如果素材是C端客户拍摄的,尽可能知会客户这一原则,能为后续视频生产达到更好的效果。

这是选了40个素材,每次挑选7~8个,用上面同样的策略剪出来的结果,可以看到重复度低了一些:

前面的视频都不难做,只对视频做了截取和拼接,还用到了字幕,之前对相关功能做了简单的介绍,客户可以灵活的组装自己策略。

如果素材足够优质,对素材简单拼接就能达到很好的效果。IMS还有特效滤镜等功能,通过随机添加特效和滤镜能达到更高的去重效果。

客户可以很容易的控制每个素材的Effects,达到随机特效很容易,IMS也有随机特效功能,让客户接入更方便。

IMS云剪辑还有更多功能对素材内容进行加工:

1、Transition转场

两个素材之间,可以添加随机转场效果,素材之间的切换有过渡效果,表现形式可以有较大的差别。

2、Crop裁剪

这里指对视频画面进行裁剪,比如裁剪视频的中间部分,或者裁剪出来视频的主要内容(商品、人物等)。

3、Flip翻转

这里指对视频进行水平翻转或垂直翻转,翻转后的视频内容有变化,但仍旧保持原视频的内容主题。

4、Speed变速

Timeline中可以调整素材的播放速度,可以进行快速或慢速播放,从而达到不一样的效果。

5、RandomClip随机截取

对素材随机截取其中的一段,客户只需要设置要截取的秒数即可。

6、Font字体

可以调整字幕的字体,可以使用官方字体,或者使用自有版权字体。

7、花字

字幕效果可以有一些变化,通过变换字幕的描边、阴影、纹理效果,可以使字幕有不同的展示效果。

8、字幕特效

字幕可以添加动画特效,同时可以控制动画的时长、循环频率。

9、智能语音Voice

口播文案是短视频中常用的功能,Timeline中的音频可以是一段文本,通过使用不同的Voice合成不同效果的人声。

10、背景音乐

通过更换背景音乐,能使成片的音频内容有变化,Timeline中的音频轨可以添加多个,同时也能对音频进行截取、拼接、调音等操作。

下面视频是添加了随机转场、随机字体、字幕动画后的效果,内容有了更多的去重度:

当然,添加过多的效果,对视频内容主体也有影响,客户可以酌情添加。IMS云剪辑Timeline是一个很灵活的结构,客户可以基于自身需求进行灵活的编排。

最后

从剪辑专业度来讲,批量混剪中用到的技术并不复杂,业务目标也是为了适配短视频平台从而更好的做广告投放,在实际生产中,客户通过对Timeline的组装,能剪辑出效果不同且质量优质的短视频成片,本篇抛砖引玉,也欢迎更多开发者来使用阿里云云剪辑,在Timeline的使用中探索更多更有趣的内容。

本篇通过几个示例,以及对Timeline功能的讲解,让大家对阿里云云剪辑有初步的认识,也欢迎加入智能媒体生产官方答疑钉钉群咨询交流

相关链接:

目录
相关文章
|
8天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2186 12
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
8天前
|
云安全 人工智能 安全
|
8天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
981 1
|
10天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
986 44
|
8天前
|
人工智能 自然语言处理 数据挖掘
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
2026年,通义千问正式推出全新旗舰级大模型 **Qwen3.8-Max-Preview 预览版**,作为首款突破万亿参数规格的新一代基座模型,该模型总参数量达到**2.4万亿**,采用全新迭代的MoE混合专家架构,综合推理性能、长文本处理、多模态理解、复杂任务规划能力全面超越前代Qwen3.7-Max版本,整体实力跻身全球第一梯队,可对标海外顶级旗舰模型,是当前面向复杂工程开发、多智能体协同、超长文档解析、专业办公自动化场景的最优国产基座模型。
987 0
|
6天前
|
自然语言处理 测试技术 API
通义千问Qwen3.8-Max-Preview全功能解析:2.4万亿参数旗舰模型深度使用指南
在大模型技术持续迭代的当下,通义千问推出的Qwen3.8-Max-Preview作为新一代旗舰预览版模型,凭借2.4万亿参数的超大规模、多模态融合能力与全场景适配特性,成为开发者与企业用户探索AI应用的核心工具。该模型采用稀疏混合专家(MoE)架构,是通义千问首个突破万亿参数的多模态模型,可同时处理文本、图像、视频与文档等多种数据形态,在全栈代码开发、复杂逻辑推理、长文档分析与多智能体协作等场景实现跨越式升级。本文将全面拆解Qwen3.8-Max-Preview的核心功能,详解API调用流程与配置方法,覆盖多场景实战技巧,帮助用户快速掌握这款旗舰模型的使用方法,充分释放其性能潜力。
476 1
|
9天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
Qwen3.8-Max-Preview是通义千问Qwen3系列旗舰MoE大模型,参数达2.4万亿,综合推理能力居行业第一梯队。支持思考/快速双模式,擅长大模型五大高难场景。现于阿里云百炼Token Plan、Qoder及QoderWork上线体验,个人版低至39元/月。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
687 1
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南