阿里OCR-图像文字的识别和理解
2018云栖大会上海峰会,阿里巴巴图像高级算法专家王永攀对阿里OCR-文字识别技术解读和应用实例分享。OCR的本质是识别图片中的文字,即在复杂的图片背景下对所需目标文字进行识别提取。主要从什么是OCR、OCR算法和读光产品及其应用进行了介绍。展示阿里OCR在文字识别中强大的应用。
阿里十年经验输出,大数据平台“数加”的前世今生
阿里云大数据业务资深专家张金银和王峰在 “云栖大会上海峰会”的深度分享。核心是从历史发展的角度解读集阿里巴巴十年的大数据能力以及上万名工程师实战检验于一身,覆盖数据采集、计算引擎、数据加工、数据分析、机器学习、数据应用等数据生产全链条的阿里云一站式大数据平台“数加”。
一张图看学霸,杭州云栖大会前13位顶尖科学家聚会
2017杭州云栖大会开幕前夕,马云在董事局密会13名顶尖科学家,包括多名中美院士。两个多小时的会谈信息量很大……中国唯一的图灵奖获得者姚期智院士、中国量子力学第一人潘建伟院士、哥伦比亚大学的Jeanette Wang教授都来了!
在开始第一个机器学习项目之前就了解的那些事儿
一份机器学习过来人的经验清单分享,主要是包含一些关于构建机器学习工作流以及Apache Spark应该注意的一些事项,希望这个清单能够帮助那些正在学习机器学习的相关人员少走一些弯路,节约一些时间。
【玩转数据系列六】文本分析算法实现新闻自动分类
新闻分类是文本挖掘领域较为常见的场景。目前很多媒体或是内容生产商对于新闻这种文本的分类常常采用人肉打标的方式,消耗了大量的人力资源。本文尝试通过智能的文本挖掘算法对于新闻文本进行分类。无需任何人肉打标,完全由机器智能化实现。