蚂蚁保险科技获“国际认知识别类技术挑战赛”双冠军

简介: 第29届ACM国际多媒体会议(ACM International Conference on Multimedia)于24日在成都落幕,作为多媒体领域的国际顶级学术会议,本次会议吸引了全球来自中国、美国、德国、澳大利亚、瑞典、法国、日本等19个国家和地区1000余名学者参会,共收到来自近40个国家,共计2000余篇论文,创下了ACM的规模纪录。

第29届ACM国际多媒体会议(ACM International Conference on Multimedia)于24日在成都落幕,作为多媒体领域的国际顶级学术会议,本次会议吸引了全球来自中国、美国、德国、澳大利亚、瑞典、法国、日本等19个国家和地区1000余名学者参会,共收到来自近40个国家,共计2000余篇论文,创下了ACM的规模纪录。

 

蚂蚁保险科技与中国科学院自动化研究所联合组队,参加了多模态认知技术挑战赛“MuSe2021”两个赛道的比赛,摘得两项冠军。

 

76435BC4-11C4-4CF8-90D8-14FA29728E0A_4_5005_c.jpeg

F1A26CC5-DA5F-40C0-9320-11595D0492A4_4_5005_c.jpeg

 

MuSe竞赛全称为The Multimodal Sentiment Challenge,由英国帝国理工学院、德国奥格斯堡大学以及新加坡南洋理工大学等高校共同举办。该挑战赛源于著名的AVEC(Audio-Visual Emotion Challenge)竞赛,自2020年开始在ACM MM会议期间定期举办,是多模态认知技术与心理学交叉学科的顶级赛事。相比于之前的AVEC竞赛,MuSe竞赛面向自然场景和复杂环境,更加注重结合语义信息的多模态深度融合能力的评测。

 

今年,MuSe2021吸引了来自全球的32支队伍参赛,共分为四个赛道,蚂蚁保险科技和与中国科学院自动化研究所组成的参赛队伍参加了其中MuSe-Wilder和MuSe-Sent 两个赛道。在这两个赛道中,参赛者基于官方提供的自然场景下音视频和文本的多模态数据,在唤醒和效价两个维度,分别预测出连续和离散标签。最终,MuSe-Wilder赛道的平均CCC指标相比第二名高0.1191,MuSe-Sent赛道的平均Macro-F1指标相比第二名高0.0671。

 

比赛中,蚂蚁保险科技团队使用了声学、视觉、文本各模态的多种low-level手工设计特征与high-level深度学习表征,并提出一种使用self-attention机制增强的BiLSTM模型,对特征序列中的复杂时序依赖进行建模。同时,采用与评测目标一致的CCC loss和F1 loss替代回归与分类问题中常用的均方误差和交叉熵损失函数,显著提升了模型性能。


在多模态信息融合阶段,业界主流技术分为前融合与后融合两种,由于在该比赛中特征维度过高,前融合效果不佳,蚂蚁保险科技团队采用了后融合方案,引入第二级BiLSTM模型,对每个独立模态的预测结果进行融合,获得了显著优于单模态预测的性能。

 

本次赛事涉及人工智能与心理学的交叉学科,在自然场景的多模态交互中的认知技术是业界的研究热点,众多国际顶级科研机构与科技企业近年来均进行了大力投入。

 

目前,多模态认知与理解技术已经落地于蚂蚁集团的保险、理财、安全、客服等多领域中。譬如,在碎屏险增信、安全反欺诈等场景中起到提升用户体验的积极作用。未来也将在重疾险理赔中发挥重要作用。

相关文章
|
9月前
|
负载均衡 监控 算法
Nginx负载均衡优化(从零开始搭建高性能Web服务)
本教程详解Nginx负载均衡配置,从安装到优化,涵盖反向代理、多种负载策略(轮询、加权轮询、IP Hash等)、健康检查与性能调优,助你构建高可用、高性能的Web架构,小白也能快速上手。
|
SQL 存储 Kubernetes
K8S搭建SQL server
K8S搭建SQL server
|
6月前
|
人工智能 网络安全 Docker
2026年零基础无影云电脑部署OpenClaw(Clawdbot)及skills喂饭级教程
2026年,OpenClaw(原Clawdbot、Moltbot)凭借“自然语言驱动+全场景自动化+零代码门槛”的核心优势,成为打工人、开发者、自由职业者的效率神器——它不用休息、不用发工资,7×24小时不间断待命,一句话就能自动完成邮件处理、文件整理、代码生成、定时任务、全网搜索等重复工作,真正实现“人在摸鱼,工作已完成”。
878 1
|
8月前
|
Prometheus 监控 Cloud Native
从系统监控到业务洞察:ARMS 自定义指标采集功能全解析
阿里云应用实时监控服务 ARMS 推出自定义指标采集功能,让 APM 真正深入业务核心,订单、库存、转化率等核心数据尽在掌控!
665 72
|
7月前
|
安全 Unix API
告别混乱时间处理:Python中time与datetime模块的实用选择
告别混乱时间处理:Python中time与datetime模块的实用选择
430 126
|
4月前
|
SQL 机器学习/深度学习 存储
企业级智能问数:为什么需要“业务本体”而非“技术映射”?
本文探讨企业智能问数的核心路径选择:为何“业务本体”语义层(如UINO方案)比“技术映射”(宽表/Text2SQL/指标平台)更适配复杂统计、跨域分析等真实场景。指出本体建模以业务对象为中心,支持动态推理与低维护泛化,是POC走向规模化落地的关键。
|
5月前
|
人工智能 API 开发者
OpenClaw低成本云上及本地部署喂饭级指南:阿里云百炼Coding Plan API多模型配置实操(Qwen3.5-Plus、Kimi-K2.5、GLM-5)
在AI编程与自动化场景中,API成本过高是开发者普遍面临的痛点——高频次使用下,按token计费的模型服务往往带来不可预期的开支。2026年阿里云百炼Coding Plan的升级,为这一问题提供了高效解决方案:以固定包月模式聚合Qwen3.5-Plus、Kimi-K2.5、GLM-5等8款主流模型,一个API Key即可自由切换,大幅降低使用成本。
2531 7
|
5月前
|
编解码 弹性计算 安全
阿里云服务器4核8G配置收费标准与活动价格:u2i实例1252.63元起,c9i实例3147.56元起
阿里云为4核8G配置云服务器提供多样实例规格,如经济型e、通用算力型u1/u2i/u2a及计算型c9i等,以满足不同应用场景需求,且收费标准因实例规格和计费模式而异。选购时,用户可从性能、场景、预算及长期规划综合考量。对于预算敏感且负载较轻的任务,经济型e实例是优选;追求高性价比,可选通用算力型u2a实例;需要稳定计算性能的,推荐通用算力型u2i实例;高性能计算需求,则应选计算型c9i实例。
|
7月前
|
机器学习/深度学习 传感器 算法
Python | K折交叉验证的参数优化的弹性网络回归预测及可视化算法
本教程介绍基于Python的K折交叉验证与参数优化的弹性网络回归预测算法,涵盖贝叶斯、随机及网格搜索三种调参方法,结合SHAP分析、密度散点图与热力图等可视化技术,适用于多领域回归任务,代码及数据完整可复现。
379 0
|
12月前
|
安全 算法 Java
Java泛型编程:类型安全与擦除机制
Java泛型详解:从基础语法到类型擦除机制,深入解析通配符与PECS原则,探讨运行时类型获取技巧及最佳实践,助你掌握泛型精髓,写出更安全、灵活的代码。

热门文章

最新文章