支付宝安全实验室获Kaggle视觉挑战赛冠军,领跑「细粒度图像分类」技术

简介: 作为一家创新型科技公司,蚂蚁集团(支付宝母公司)科技战略进程不断加速。

近日,计算机视觉A类顶级会议CVPR 2020 开幕在即, 由Kaggle承办的FGVC(Fine-Grained Visual Categorization,细粒度图像分类)全球挑战赛结果揭晓,支付宝天筭安全实验室夺冠,超越全球1316支顶尖计算机视觉团队。Kaggle是全球最大机器学习平台。

0001.png

Kaggle 2020-FGVC挑战赛官方排名

作为人工智能核心能力,计算机视觉对细粒度图像分类技术要求越来越高。只有让机器「看得」更细更准,机器的判断才能有所突破。细粒度图像分类针对的是更微观的物体类别,比如,不仅要识别出它是一只鸟,还要判断具体属于哪一类鸟,识别出车要判断它的款式等。

细粒度图像分类是计算机视觉领域极具挑战的方向。今年,围绕该方向Kaggle共发起六项任务,支付宝参加其中的患病植物图像分类。比赛考察AI视觉识别技术对苹果树叶子图片进行不同种类的疾病区分能力,在训练集1821张图像和测试集1821张图像中,完成高精确度的判别。

0002.png

模型不仅可以准确分类,还能通过热力图的方式较为准确地定位到患病区域

世界上有约37万种植物,不同植物的病因完全不同,但多数植物的病态外观和特征却非常相似。另一方面,采集拍摄中存在姿态、视角、光照、遮挡、背景干扰等影响因素,使分类更加具有难度。

支付宝天筭安全实验室使用的原创模型,是基于数据增强、知识蒸馏方法,实现在大量信息干扰下进行物体具像化特征识别,使细粒度识别精度大幅提升。支付宝是比赛中唯一使用知识蒸馏这种深度学习方法的团队,在最终测试中,支付宝分数达 0.98445,排名第一。

例如,生了病的两片树叶,同样出现了破损孔洞,在传统模型训练下,AI最多可以识别出它们都是苹果树的树叶,很难确定两个孔洞之间的区别,进而给出推断树叶究竟得的是哪两种疾病。而支付宝的AI模型通过明确识别关键是孔洞大小、数量、位置,以及周边是否有斑点,最终快速给出树叶由于化学药品滥用造成损伤的判断。

缺乏标准信息数据导致难以判别的核心痛点,在医疗、金融、客服等领域大量存在,意味着这项技术拥有广阔的应用空间。在支付宝交易纠纷、资金盗用、医疗保险报销等场景中,AI团队已经开始使用该技术方法,快速识别并进行更准确的风险预测,保障用户需求在安全环境中被满足。

人工智能是蚂蚁集团核心技术引擎之一,研究领域涵盖NLP、计算机视觉、智能风控、智能营销、智能资金管理等,并在大规模分布式机器学习、深度图学习、多方安全与隐私计算、博弈与对抗智能、多智能体、强化学习等方向取得突破。蚂蚁集团首席AI科学家 、达摩院金融智能负责人漆远带领的全球化团队,在深度赋能蚂蚁各条业务的同时,相继在国际人工智能顶级会议NeurIPS、ICML 、AAAI等,发表近60篇高质量论文成果,申报了超200个专利。

作为一家创新型科技公司,蚂蚁集团(支付宝母公司)科技战略进程不断加速。除AI之外,在区块链、数据库等领域近期也频现突破性进展。日前,蚂蚁集团将数据库业务OceanBase升格为独立公司,未来三年计划服务全球客户超万家;蚂蚁区块链的跨链技术在获得专利授权的同时,还被全球最大专业技术组织IEEE认定为国际标准。目前,蚂蚁集团员工中,技术人员占比已经超过63%。

相关文章
|
1月前
|
机器学习/深度学习 人工智能 计算机视觉
ConsisID:北大联合鹏城实验室等机构推出的文本到视频生成模型
ConsisID是由北京大学和鹏城实验室等机构联合推出的文本到视频生成模型,专注于保持视频中人物身份的一致性。该模型采用频率分解技术和免调优的Diffusion Transformer架构,能够在多个评估维度上超越现有技术,推动身份一致性视频生成技术的发展。
155 73
ConsisID:北大联合鹏城实验室等机构推出的文本到视频生成模型
|
1月前
|
机器学习/深度学习 人工智能 达摩院
MVGenMaster:复旦联合阿里等实验室推出的多视图扩散模型
MVGenMaster是由复旦大学、阿里巴巴达摩院和湖潘实验室联合推出的多视图扩散模型,专注于新视角合成(NVS)任务。该模型通过整合3D先验信息,显著提升了NVS的泛化和3D一致性,并能从单一图像生成多达100个新视图。此外,研究团队还推出了包含160万场景的大型多视图图像数据集MvD-1M,以支持模型的训练和优化。
89 27
MVGenMaster:复旦联合阿里等实验室推出的多视图扩散模型
|
2月前
|
人工智能 API
EvolveDirector:阿里联合南洋理工推出文本到图像生成模型的高效训练技术
EvolveDirector是由阿里巴巴和南洋理工大学联合推出的文本到图像生成模型的高效训练技术。该框架通过与高级模型的API交互获取数据对,并利用预训练的大型视觉语言模型(VLMs)动态优化训练数据集,显著减少了数据量和训练成本。EvolveDirector能够从多个高级模型中选择最佳样本进行学习,使最终训练出的模型在多个方面超越现有高级模型。
54 0
EvolveDirector:阿里联合南洋理工推出文本到图像生成模型的高效训练技术
|
5月前
|
人工智能 算法 数据安全/隐私保护
无表情人脸预测政治信仰,AI准确率惊人!斯坦福研究登国际顶刊
【8月更文挑战第10天】斯坦福大学的研究揭示了面部识别技术的新应用:通过分析无表情人脸图片预测政治倾向。研究在《American Psychologist》发表,表明人类评估者与AI均能在控制人口统计学特征的情况下准确预测政治取向,相关系数分别为0.21和0.22。利用年龄、性别和种族信息时,算法准确性提升至0.31。研究还发现保守派倾向于有更大的下半部面部。尽管成果引人注目,但其局限性和潜在的隐私问题仍需审慎考量。
159 62
|
6月前
|
人工智能 算法
第四届 Data-Juicer数据挑战赛暨天池 Better Synth 多模态大模型数据合成挑战赛
阿里云、NVIDIA主办,阿里云天池平台、魔搭社区、阿里巴巴通义实验室共同组织的第四届 Data-Juicer 数据挑战赛,暨天池 Better Synth 多模态大模型数据合成挑战赛开赛啦~
|
8月前
|
数据采集 人工智能 JSON
跨越千年医学对话:用AI技术解锁中医古籍知识,构建能够精准问答的智能语言模型,成就专业级古籍解读助手(LLAMA)
跨越千年医学对话:用AI技术解锁中医古籍知识,构建能够精准问答的智能语言模型,成就专业级古籍解读助手(LLAMA)【2月更文挑战第1天】
 跨越千年医学对话:用AI技术解锁中医古籍知识,构建能够精准问答的智能语言模型,成就专业级古籍解读助手(LLAMA)
|
算法 自动驾驶 测试技术
华中科大、百度&港大联合出品 | ByteTrackV2: 一种简单且强大的 2D/3D 多目标跟踪框架,横扫多项任务SOTA!
华中科大、百度&港大联合出品 | ByteTrackV2: 一种简单且强大的 2D/3D 多目标跟踪框架,横扫多项任务SOTA!
686 0
华中科大、百度&港大联合出品 | ByteTrackV2: 一种简单且强大的 2D/3D 多目标跟踪框架,横扫多项任务SOTA!
|
机器学习/深度学习 存储 人工智能
NeurIPS 2022 | 中山大学HCP实验室在AIGC领域的新突破:有效表示多样化衣物的3D神经表示模型
NeurIPS 2022 | 中山大学HCP实验室在AIGC领域的新突破:有效表示多样化衣物的3D神经表示模型
139 0
|
机器学习/深度学习 人工智能 算法
Copilot被告、LeCun自主AI、AlphaFold发现所有蛋白质……2022年激动人心的AI大新闻
Copilot被告、LeCun自主AI、AlphaFold发现所有蛋白质……2022年激动人心的AI大新闻
131 0
|
机器学习/深度学习 人工智能 安全
人类首次完全利用AI发现「迄今最强抗生素」,登上《细胞》杂志封面
MIT 科学家用深度学习模型发现的「halicin」抗生素分子展示了前所未有的广谱抗菌能力,这是人类首次完全使用人工智能的方法发现新抗生素。研究人员表示,halicin 可以消灭一些世界上最危险的细菌。他们的这一研究登上了生命科学顶级期刊《Cell》。
387 0
人类首次完全利用AI发现「迄今最强抗生素」,登上《细胞》杂志封面