厉害了!阿里安全图灵实验室在ICDAR2017 MLT竞赛刷新世界最好成绩

本文涉及的产品
企业资质识别,企业资质识别 200次/月
内容审核增强版开发者实践包,10万次资源包1年有效
自定义KV模板,自定义KV模板 500次/账号
简介: 近日,阿里安全图灵实验室(Alibaba Turing Lab)的ATL Cangjie OCR算法在ICDAR2017的MLT(Competition on Multi-lingual scene text detection)自然场景多语言文本检测竞赛中刷新了世界最好成绩,以73.52%的Hmean排名第一。

近日,阿里安全图灵实验室(Alibaba Turing Lab)的ATL Cangjie OCR算法在ICDAR2017的MLT(Competition on Multi-lingual scene text detection)自然场景多语言文本检测竞赛中刷新了世界最好成绩,以73.52%的Hmean排名第一。(竞赛结果页面:http://rrc.cvc.uab.es/?ch=8&com=evaluation&task=1
e095e4e548cd283fe2eab7e77428c921

据了解,ICDAR(International Conference on Document Analysis and Recognition)具有OCR领域的奥斯卡盛会之称,是全球OCR领域公认最权威的比赛之一。

当前,OCR技术被广泛应用于多个领域。从名片、发票、银行卡等票据的数字化到室外街道商店索引,路标路牌识别;再到图片、视频文字内容理解与内容安全,OCR技术都发挥着越来越重要的作用。

阿里安全图灵实验室研究人员称,在技术上,文本检测和识别需要应付各种考验和挑战,如自然场景下光照的影响,物体的遮挡,文字大小、比例、角度的变化,图像视频中文字的模糊等等。ICDAR2017 MLT竞赛包含了中、日、韩、拉丁(英、法、德、意)、阿拉伯和孟加拉等9种语言,其图像采集自各种各样的场景,其中的文本的长度、字体、尺寸、颜色千变万化,同时还包含了许多真实场景的噪声包括光照、遮挡、倾斜、文字堆叠、文字镶嵌、透视变化等等,这对于OCR算法的适应能力更具挑战性。

为攻克这些难题,阿里安全图灵实验室的研究人员设计了基于深度学习的网络模型和算法。

据介绍,图灵实验室的研究人员在文字检测模型方面,采用深度卷积神经网络获得更深层的图像特征;并利用多尺度特征和非对称卷积核获得更好的感受视野,从而适应各种环境,各种大小、比例、角度的文字。此外,由于框架采用创新性的检测策略,因此相较于传统的RCNN-based方案,在检测速度上有很大提升。在文字识别模型,图灵实验室的研究人员在主流方案的基础上,做了全新的探索和研究,从而获得了更为有效的识别模型,在保证识别准确率的前提下,提高了识别效率。

阿里安全图灵实验室研究人员表示,ATL Cangjie OCR提供在线同步、异步通用OCR文字检测和识别服务,以及离线ODPS服务,为图片文字内容理解与内容安全提供强有力的技术支撑。该模型已经全面支撑阿里生态中的商品内容安全、业务安全、平台治理、评价、交互、认证等多个业务场景,同时,还通过阿里云盾-内容安全(绿网)产品,输出给第三方客户使用。

目前,ATL Cangjie OCR服务日均调用量几亿次,可为客户提供稳定的技术保障。

目录
相关文章
恭喜这715位选手,入围2022阿里巴巴全球数学竞赛决赛!
恭喜这715位选手,入围2022阿里巴巴全球数学竞赛决赛!
709 0
|
存储 搜索推荐 算法
清华、人大等机构学者获唯一最佳论文奖,数据挖掘顶会WSDM'22线上召开
清华、人大等机构学者获唯一最佳论文奖,数据挖掘顶会WSDM'22线上召开
141 0
|
机器学习/深度学习 人工智能
Science年度十大科学研究公布:韦伯望远镜当选,AIGC陪跑!
Science年度十大科学研究公布:韦伯望远镜当选,AIGC陪跑!
111 0
揭秘CCF国际AIOps挑战赛选手背后的“武林神器”
CCF国际AIOps挑战赛揭秘选手背后的“武林神器”
1041 0
揭秘CCF国际AIOps挑战赛选手背后的“武林神器”
|
机器学习/深度学习 开发者
机器学习平台PAI”活动一等奖名单
机器学习平台PAI”活动一等奖名单
机器学习平台PAI”活动一等奖名单
|
机器学习/深度学习 Python
ML之预测:玩转2018世界杯—采用机器学习预测小组赛、十六比赛、四决赛、半决赛、决赛以及世界杯总冠军的各个队伍
ML之预测:玩转2018世界杯—采用机器学习预测小组赛、十六比赛、四决赛、半决赛、决赛以及世界杯总冠军的各个队伍
ML之预测:玩转2018世界杯—采用机器学习预测小组赛、十六比赛、四决赛、半决赛、决赛以及世界杯总冠军的各个队伍
|
机器学习/深度学习 人工智能 安全
托福被取消?这个英语测试AI出题,2天出分,全球900+大学承认
托福被取消?这个英语测试AI出题,2天出分,全球900+大学承认
228 0
托福被取消?这个英语测试AI出题,2天出分,全球900+大学承认
第二届阿里巴巴全球数学竞赛试题(预选赛第一轮)
第二届阿里巴巴全球数学竞赛,完整试题来啦!
33459 0
第二届阿里巴巴全球数学竞赛试题(预选赛第一轮)
|
人工智能 算法 数据挖掘
"‘天池·TEENTOP杯’AI少年挑战赛”航班启航,Python+数据科学双赛道承载少年 AI 梦
6月11日,“‘天池·TEENTOP杯’AI少年挑战赛”正式启动。本次大赛由阿里云天池主办,TEENTOP大赛平台、钉钉协办,提供Python+数据科学双赛道,并配套有免费的线上课程及编程平台。 “‘天池·TEENTOP杯’AI少年挑战赛”通过强强联手,为国内青少年提供数据科学竞技平台,旨在推动国内中小学的人工智能基础教育,挖掘和展示中国未来科技人才的智慧和能力,支持和鼓励更多优秀青少年加入数据科学的创新实践队伍。
1296 0
"‘天池·TEENTOP杯’AI少年挑战赛”航班启航,Python+数据科学双赛道承载少年 AI 梦
|
机器学习/深度学习 Cloud Native 算法
机器学习PAI有奖调研获奖名单
感谢大家参与机器学习PAI有奖调研活动,在这些留言中有很多是对产品建设、技术优化有重大帮助的内容,我们特别为这些开发者准备了PAI定制t恤,礼品会在2020年10月13日发出,请获奖用户留意查收。
884 0
机器学习PAI有奖调研获奖名单