阿里云视觉AI应用创新赛开启——技术公开篇之AlibabaWood

简介:

移动互联网时代以来,人工智能(AI)技术不断发展和完善,不断展现出巨大的商业潜力,并开始在各行各业落地开花,其中计算机视觉AI技术发展最快应用最广。阿里云为响应国家“加快新型基础设施建设“的号召,以“无行业不AI“为主题,特此举办阿里云视觉AI应用创新赛,为行业应用及解决方案落地提供展示创意和想法的舞台。

本次大赛向全行业开发者用户开放,针对优秀人才、优秀作品提供百万现金奖池,为创业人才提供包括阿里巴巴资源对接与扶持、技术培训和上云指导以及导师帮助等与初创企业相关的综合服务。同时为协助本次赛事,阿里云将会与参赛者共享阿里内部视觉AI开发的实践经验,从技术,资金,资源三方面帮助企业实现场景落地。

image.png


本文将会通过解析AlibabaWood视频生产工具的算法来介绍视觉AI技术在新零售电商领域中的应用,为参赛人员开发视觉AI应用提供一种可行的思路。

AlibabaWOOD介绍

AlibabaWOOD是阿里云为了提升电商营销视频制作效率和质量而推出的工具。在电商平台,投放商品视频展示可以增加信息传播途径提升引流曝光,针对同一商品,是否投放视频展示对各关键指标影响非常大,如下图所示。

image.png
图1 单一商品图像款对比视频款


但传统的批量视频制作通常依赖于设计师提前制作的固定模板,且大批量生产的视频通常千篇一律,缺乏感染力。为了解决这一问题,AlibabaWOOD充分利用目前最先进的AI技术,抛弃了死板的视频模板,而是通过智能分析用户输入的音视频素材以及用户需求,一键生成符合投放场景的营销短视频,从分析、设计到最后的编码输出用时不超过一分钟,远远超过人类制作视频的速度。并且,得益于AI技术的应用,AlibabaWOOD可以做到视频风格和内容千人千面,无论是时尚风、科技风还是土味视频,AlibabaWOOD都可以从容应对。下图展示了AlibabaWOOD智能生成视频的核心流程,下一章节也会对其中的核心AI技术进行解析。

image.png
图2 AlibabaWOOD智能视频生成流程

AlibabaWOOD核心AI技术解析
素材解析能力

• 素材质量评估/理解:
AlibabaWood利用最新的深度学习技术以及线上海量的电商图像视频数据,自研了素材质量评估模型和素材内容理解模型,质量评估模型可以快速准确的滤除不适合制作视频的图像视频素材,保证输出视频的质量。而内容理解模型能够为智能编排模块提供全方位的素材标签,方便为素材精确匹配智能特效,如下图所示:

image.png


图3 素材质量评估

image.png


图4 素材标签示例

• 故事线生成:
作为智能编排核心技术,故事线生成模型充分利用素材标签以及美学和吸引力评分,结合影视行业规范等先验知识,可以针对不同类型的图像视频素材推荐不同的素材排序故事线,如下图所示。使得生成的视频运镜更加合理,并更具吸引力和感染力。

image.png


图5 故事线生成示例


• 视频摘要:
通过学习大量在线营销视频摘要模式,AlibabaWood适配不同视频类别的视频剪辑手法,能够对用户输入的视频素材进行镜头分割,并根据投放场景选择最佳视频片段进行剪辑。

image.png


图6 视频摘要示例

智能特效
• 音画联动:
视频节奏感可以提升观看视频的舒适性。通过智能分析音频节奏点和视频内容的视觉“节奏点”,然后通过视频插帧技术实现视频播放速率的非线性变换,从而实现音视频节奏点的完美匹配,使得视频中的人物能够随音乐舞动,极大的提升了视频内容的吸引力。
• 静转动:
为了增强静态素材主体内容的吸引力,AlibabaWood在自研图像分割能力的基础上推出静转动等智能特效,这一能力可以自动识别模特展示图像,然后对模特主体进行抠图,再对前景和背景内容加入滑动变焦效果,将静态图像转化为动态的视频内容,使得内容展示更加生动,并凸显主体信息。下一代静转动技术可以使得运镜效果更符合透视原理,并让图像中模特的肢体真正动起来。

image.png


图7 图像分割示例


• 转场等特效智能推荐:
AlibabaWood联合设计师打造了可以根据素材内容自动匹配的转场动画特效体系。使得生成的视频动效更加丰富、更加个性化,真正做到千人千面。部分效果展示如下。

image.png


图8 智能转场特效


阿里云视觉AI开发者创意应用赛向社会各界免费开放所有视觉AI技术接口,邀请全社会的企业打造属于自己的AlibabaWood。开发者可以任意使用达摩院的技术打磨自己的产品,或者将自己的产品在大赛中展出,作为主办方,阿里云将会为优秀的作品对接创业资源和孵化环境,更有总计近百万的奖金和奖品等你来拿。

体验地址https://vision.aliyun.com/experience
大赛平台https://developer.aliyun.com/ai/activity/viapi

相关文章
|
19小时前
|
机器学习/深度学习 人工智能 自然语言处理
AIGC技术深度解析:生成式AI的革命性突破与产业应用实战
蒋星熠Jaxonic,AI技术探索者,深耕生成式AI领域。本文系统解析AIGC核心技术,涵盖Transformer架构、主流模型对比与实战应用,分享文本生成、图像创作等场景的实践经验,展望技术趋势与产业前景,助力开发者构建完整认知体系,共赴AI原生时代。
21 1
|
2天前
|
人工智能 自然语言处理 算法
现代AI工具深度解析:从GPT到多模态的技术革命与实战应用
蒋星熠Jaxonic,AI技术探索者,深耕代码生成、多模态AI与提示词工程。分享AI工具架构、实战应用与优化策略,助力开发者提升效率,共赴智能编程新纪元。
19 4
|
5天前
|
人工智能 关系型数据库 OLAP
一键搞定本土认证难题,AnalyticDB版Supabase助力AI应用实现支付宝&微信登录
阿里云AnalyticDB PostgreSQL版推出全新第三方身份认证能力,原生支持微信、支付宝、GitHub、Google、Apple等主流平台登录,助力开发者快速构建本土化用户系统。相比传统开发方式,无需从零开发认证模块,5分钟即可完成集成,大幅降低开发成本。适用于AI应用、创业项目及企业级智能应用,提升用户增长效率,实现安全、便捷的身份管理。
|
5天前
|
人工智能 机器人 新能源
深化新工科建设 共探智能新未来 | 阿里云支持南京大学苏州校区“AI DAY”盛大启幕丨云工开物
9月12日,南京大学苏州校区举办“AI新视界:深化新工科建设进行式”活动,采用教师与学生双专场模式,通过主题分享、实践演练、产业课题发布等形式,搭建产教融合AI交流平台,助力未来产业科技人才培养。
|
5天前
|
存储 人工智能 关系型数据库
阿里云AnalyticDB for PostgreSQL 入选VLDB 2025:统一架构破局HTAP,Beam+Laser引擎赋能Data+AI融合新范式
在数据驱动与人工智能深度融合的时代,企业对数据仓库的需求早已超越“查得快”这一基础能力。面对传统数仓挑战,阿里云瑶池数据库AnalyticDB for PostgreSQL(简称ADB-PG)创新性地构建了统一架构下的Shared-Nothing与Shared-Storage双模融合体系,并自主研发Beam混合存储引擎与Laser向量化执行引擎,全面解决HTAP场景下性能、弹性、成本与实时性的矛盾。 近日,相关研究成果发表于在英国伦敦召开的数据库领域顶级会议 VLDB 2025,标志着中国自研云数仓技术再次登上国际舞台。
62 0
|
人工智能 算法 自动驾驶
知乎对话阿里云:透视AI应用难题与未来趋势
自AlphaGo接连战胜李世石与柯洁后,越来越多从业者将AI看做科技行业的未来。大大小小的AI公司兴起,国内外巨头公司纷纷加速向AI转型。但经历祛魅后的AI,在过去几年间却并未获得观察者们预想的火箭式爆发。 “AI行业接下来可能有哪些发展?” “一线从业者如何看待其中的机会?”近日,知乎合伙人、CTO李大海与阿里巴巴副总裁、阿里云智能高级研究员贾扬清亮相知乎直播,与网友分享了他们对AI时代下行业趋势、技术应用、个人成长等多个层面的洞察和思考。
553 0
知乎对话阿里云:透视AI应用难题与未来趋势
|
5天前
|
人工智能 Kubernetes 安全
重塑云上 AI 应用“运行时”,函数计算进化之路
回顾历史,电网的修建,深刻地改变了世界的经济地理和创新格局。今天,一个 AI 原生的云端运行时的进化,其意义也远不止于技术本身。这是一次设计哲学的升华:从“让应用适应平台”到“让平台主动理解和适应智能应用”的转变。当一个强大、易用、经济且安全的 AI 运行时成为像水电一样的基础设施时,它将极大地降低创新的门槛。一个独立的开发者、一个小型创业团队,将有能力去创造和部署世界级的 AI 应用。这才是技术平权的真谛,是激发全社会创新潜能的关键。
|
5天前
|
人工智能 算法 数据挖掘
AI Agent工作流实用手册:5种常见模式的实现与应用,助力生产环境稳定性
本文介绍了五种AI Agent结构化工作流模式,帮助解决传统提示词方式在生产环境中输出不稳定、质量不可控的问题。通过串行链式处理、智能路由、并行处理、编排器-工作器架构和评估器-优化器循环,可提升任务执行效率、资源利用和输出质量,适用于复杂、高要求的AI应用。
114 0
AI Agent工作流实用手册:5种常见模式的实现与应用,助力生产环境稳定性
人工智能 关系型数据库 OLAP
47 0

热门文章

最新文章