VE-Bench:北京大学开源首个针对视频编辑质量的评估指标,从多角度考虑审美并准确地评估视频编辑效果

简介: 北京大学开源了首个针对视频编辑质量评估的新指标 VE-Bench,旨在通过人类感知一致的度量标准,更准确地评估视频编辑效果。

❤️ 如果你也关注 AI 的发展现状,且对 AI 应用开发非常感兴趣,我会每日跟你分享最新的 AI 资讯和开源应用,也会不定期分享自己的想法和开源实例,欢迎关注我哦!

🥦 微信公众号|搜一搜:蚝油菜花 🥦

原文链接:https://mp.weixin.qq.com/s/n7_9RwaZD7IhQr7Fe2pQHQ


🚀 快速阅读

  1. 功能:VE-Bench 包含视频质量评估模型和数据库,用于评估文本驱动的视频编辑任务。
  2. 技术:采用深度学习算法和多模态学习框架,评估文本-视频一致性和源视频-编辑后视频动态相关性。
  3. 应用:适用于电影制作、短视频平台内容优化和广告行业精准营销。

正文(附运行示例)

VE-Bench 是什么

公众号: 蚝油菜花 - VE-Bench

VE-Bench 是北京大学研究团队 MMCAL 发布的首个专门针对视频编辑质量评估的指标。其设计目标是与人类感知能力高度一致,更准确地评估视频编辑效果。VE-Bench 不仅考虑了传统视频质量评估方法强调的审美、失真等视觉质量指标,还专注于文本与视频的对齐以及源视频与编辑后视频之间的相关性建模。

VE-Bench 包含两个主要部分:VE-Bench DB 和 VE-Bench QA。VE-Bench DB 是一个视频质量评估数据库,包含了丰富的源视频、编辑指令、不同视频编辑模型的编辑结果,以及24名不同背景参与者的主观评分样本,共计28,080个评分样本。VE-Bench QA 是一个量化的、与人类感知一致的度量工具,专门用于文本驱动的视频编辑任务。

VE-Bench 的主要功能

  • 视频质量评估模型(VE-Bench QA):为编辑后的视频提供与人类感知一致的度量标准,考虑了传统视频质量评估方法强调的审美、失真等视觉质量指标,还专注于文本与视频的对齐以及源视频与编辑后视频之间的相关性建模。
  • 视频质量评估数据库(VE-Bench DB):包含了丰富的源视频、编辑指令、不同视频编辑模型的编辑结果,以及24名不同背景参与者的主观评分样本,共计28,080个评分样本。
  • 文本-视频一致性评估:基于BLIP进行视频-文本相关性建模,通过在BLIP视觉分支的基础上加入Temporal Adapter将其扩展到三维,并与文本分支的结果通过交叉注意力得到输出。
  • 源视频-编辑后视频动态相关性评估:通过时空Transformer将源视频和编辑后视频投影到高维空间,在此基础上拼接后利用注意力机制计算二者相关性,最后通过回归计算得到相应输出。
  • 传统视觉质量评估:参考了过往自然场景视频质量评价的优秀工作DOVER,通过在美学和失真方面预训练过后的骨干网络输出相应结果。
  • 多维度评估:从文本-视频一致性、源视频-编辑后视频动态相关性以及传统视觉质量三个维度对文本驱动的视频编辑进行评估。

VE-Bench 的技术原理

  • 线性层回归:最终各个分支的输出通过线性层回归得到最终分数。
  • 深度学习算法:通过对大量真实世界视频样本的学习,建立了能够模拟人类视觉和听觉系统的模型。
  • 多模态学习框架:能同时处理视频中的图像、音频和文本信息,通过大量的真实世界视频样本训练,学会了如何分析视频的技术参数,捕捉那些难以量化的艺术美感和情感表达。

如何运行 VE-Bench

VE-Bench 可以通过 pip 命令安装,并支持视频对的比较评估。以下是一个简单的使用示例:

pip install vebench
from vebench import VEBenchModel

evaluator = VEBenchModel()

score1 = evaluator.evaluate('A black-haired boy is turning his head', 'assets/src.mp4', 'assets/dst.mp4')
score2 = evaluator.evaluate('A black-haired boy is turning his head', 'assets/src.mp4', 'assets/dst2.mp4')
print(score1, score2) # Score1: 1.3563, Score2: 0.66194

资源


❤️ 如果你也关注 AI 的发展现状,且对 AI 应用开发非常感兴趣,我会每日跟你分享最新的 AI 资讯和开源应用,也会不定期分享自己的想法和开源实例,欢迎关注我哦!

🥦 微信公众号|搜一搜:蚝油菜花 🥦

相关文章
|
6月前
|
数据挖掘 Linux 网络安全
喂饭级教程:OpenClaw(Clawdbot)阿里云/本地部署+自媒体Skill集成,高效告别重复劳动!
对自媒体人而言,最耗时的痛点莫过于“全流程碎片化”——市场调研要刷多平台、文案创作要反复修改、视觉设计依赖专业工具、多平台发布需重复操作,一套流程下来往往耗费数小时,却难见高效产出。而OpenClaw(原Clawdbot)的Skill生态,恰好针对性解决了这一问题:42款核心技能覆盖自媒体运营10大环节,从热点追踪、选题策划到内容发布、数据分析,实现全流程自动化赋能。
2886 2
|
3月前
|
存储 弹性计算 安全
阿里云服务器收费标准与活动价格:2026最新ECS、轻量、GPU价格与优惠解析
本文整理了阿里云服务器(ECS)、轻量应用服务器及GPU云服务器的2025年最新收费标准与活动优惠。轻量应用服务器2核2G配置低至38元/年,性价比突出;ECS经济型e实例2核2G活动价99元/年,人人可享且续费不涨价;2核4G企业专享199元/年,2核8G经济型月付162元起。GPU云服务器方面,A10卡GN7i实例32核188G活动价3213.99元/月起。
|
8月前
|
数据采集 存储 运维
2025年主流接口监控平台对比分析与最佳实践指南
文章围绕2025年接口监控平台展开,对比商业SaaS、开源自建、全栈整合型三种主流方案。分析行业背景、痛点,阐述各方案优劣及适用场景,介绍技术原理与最佳实践路径,还解答常见选型问题,助力企业根据自身情况选择合适方案,保障接口稳定。
|
弹性计算 Ubuntu Linux
快速部署 Docker 社区版
Docker Community Edition (CE) 是Docker项目的免费版本,面向广大开发者、爱好者以及希望利用容器技术的个人和组织。它是Docker企业版(Docker Enterprise Edition, EE)的社区驱动对应版,提供了强大的容器化应用构建、部署和运行能力。本文解释如何通过计算巢快速部署Docker社区版。
快速部署 Docker 社区版
|
机器学习/深度学习 编解码 算法
AIGC生图的自动化质量评估(1)
AIGC生图的自动化质量评估
1372 6
|
机器学习/深度学习 数据可视化 机器人
比扩散策略更高效的生成模型:流匹配的理论基础与Pytorch代码实现
扩散模型和流匹配是生成高分辨率数据(如图像和机器人轨迹)的先进技术。扩散模型通过逐步去噪生成数据,其代表应用Stable Diffusion已扩展至机器人学领域形成“扩散策略”。流匹配作为更通用的方法,通过学习时间依赖的速度场将噪声转化为目标分布,适用于图像生成和机器人轨迹生成,且通常以较少资源实现更快生成。 本文深入解析流匹配在图像生成中的应用,核心思想是将图像视为随机变量的实现,并通过速度场将源分布转换为目标分布。文中提供了一维模型训练实例,展示了如何用神经网络学习速度场,以及使用最大均值差异(MMD)改进训练效果。与扩散模型相比,流匹配结构简单,资源需求低,适合多模态分布生成。
1616 17
比扩散策略更高效的生成模型:流匹配的理论基础与Pytorch代码实现
|
存储 缓存 弹性计算
重新审视 CXL 时代下的分布式内存
从以太网到 RDMA 再到 CXL,标志着互连技术的重大突破。
|
存储 人工智能 调度
直播回放 | 高性能智算集群设计思考与实践
本次分享的主题是高性能智算集群设计思考与实践,由阿里云灵骏智算集群产品解决方案负责人丛培岩分享。 1. AGI对基础设施的挑战 2. 高性能智算集群的设计实践 3. 思考与展望
601 1
|
负载均衡 应用服务中间件 nginx
如何使用nginx实现负载均衡?
如何使用nginx实现负载均衡?
|
传感器 物联网 数据中心
探索ARM架构及其核心系列应用和优势
ARM架构因其高效、低功耗和灵活的设计,已成为现代电子设备的核心处理器选择。Cortex-A、Cortex-R和Cortex-M系列分别针对高性能计算、实时系统和低功耗嵌入式应用,满足了不同领域的需求。无论是智能手机、嵌入式控制系统,还是物联网设备,ARM架构都以其卓越的性能和灵活性在全球市场中占据了重要地位。
2056 1

热门文章

最新文章