视觉智能开放平台

首页 标签 视觉智能开放平台
图像文字识别(OCR)用什么算法小结
说明:主要考虑深度学习的方法,传统的方法不在考虑范围之内。 1.文字识别步骤 1.1detection:找到有文字的区域(proposal)。 1.2classification:识别区域中的文字。 2.文字检测 文字检测主要有两条线,两步法和一步法。
阿里云智能图像识别服务发布
本文的整理自2017云栖大会-上海峰会上阿里巴巴iDST研究员华先胜,关于智能图像识别服务发布的讲义。从图像识别介绍、到市场分析、再到阿里云解决方案,最后进行了功能展示以及介绍了如何调用服务的方式。
【OpenCV学习笔记 023】两种图像分割方法比较
【OpenCV学习笔记 023】两种图像分割方法比较 此次研究两种图像分割法,分别是基于形态学的分水岭算法和基于图割理论的GrabCut算法。OpenCV均提供了两张算法或其变种。鉴于研究所需,记录一些知识点,开发平台为OpenCV2.4.9+Qt5.3.2。
阿里云达摩院资深算法专家浅谈:视觉生产技术探索及应用
本次我们邀请到了阿里巴巴达摩院的资深算法专家谢宣松,来给大家分享基于阿里云在视觉生产技术上的探索和应用。
吴恩达《机器学习》课程总结(18)应用实例:图片文字识别
18.1问题描述和流程图 (1)图像文字识别是从给定的一张图片中识别文字。 (2)流程包括: 1.文字侦测 2.字符切分(现在不需要切分了) 3.字符分类 18.2滑动窗口 在行人检测中,滑动窗口是首先训练一个固定尺寸输入的判断是否有行人的网络,然后在一张图片中裁该尺寸的图片,送入到网络中;然后不断移动裁剪区,重复以上过程,知道裁剪到最后,这时按比例放大裁剪区,然后将裁剪到的图片缩放到网络的输入,如此循环。
免费试用