阿里云视觉智能开放平台正式上线,阿里集团核心视觉AI能力对外开放

简介:

1月底,阿里云正式推出以计算机视觉AI能力为核心的视觉智能开放平台(vision.aliyun.com),平台目前已上线8大类目,超过50多种视觉AI能力,面向人脸识别,文字识别,商品理解,内容安全,图像识别,图像增强,目标检测等多个视觉应用核心场景。所有视觉AI能力都以API方式进行开放,最大程度降低开发者接入成本。

阿里云作为亚洲最大的公有云服务商,支撑起了国内最大的零售平台淘宝,天猫,最大的支付平台支付宝,背后得益于雄厚的技术研发能力和运维能力。视觉技术作为AI领域应用最广泛的技术之一,在阿里巴巴内部一直作为核心技术不停的进行研发创新,最终形成了成熟的视觉体系。今天,阿里这些所有成熟的视觉AI都能在阿里云视觉智能平台调用(vision.aliyun.com)

据了解,阿里云视觉智能平台上所有AI能力均来自阿里巴巴经济体,包括达摩院、阿里云、支付宝、菜鸟、天猫等事业部,其中包含了深度学习、图像识别、OCR,图计算等方面的最新前沿研究成果,并且所有AI能力都经过了阿里经济体的具体应用与实践,确保各能力符合场景实际需求。

平台特点

阿里云视觉智能平台荟聚了阿里巴巴集团最专业、全面、易用的视觉AI能力,同时还提供最快捷有效的方式为开发者提供服务,降低开发者研发成本,降低使用门槛,让小白也能使用人工智能。
01.jpg

平台能力

平台已经上线超过50种AI能力,涵盖8大类目视觉智能能力,以满足开发者在安防、数字营销、新零售、生活娱乐等方面的功能开发需求。还有100+AI能力在陆续上新中。具体能力如下所示:

人脸识别:人脸数量检测,人脸特征点检测,人脸定位检测,人脸置信度检测,人脸姿态检测,人脸特征点定位检测,瞳孔检测,性别识别,年龄识别,简单表情识别,佩戴眼镜识别,人脸属性识别,人脸对比1:1,人脸对比1:N

文字识别:身份证识别,户口页识别,银行卡识别,名片识别,驾驶证识别,行驶证识别,车牌识别,VIN码识别,出租车发票识别,火车票识别,营业执照识别,公章识别,通用文字识别,表格识别

商品理解:商品分类

内容安全:图片智能鉴黄,图片暴恐涉政识别,图片logo识别,图片垃圾广告识别,图片不良场景识别,图片风险人物识别

图像识别:颜色识别,风格识别,元素识别,通用图像打标,场景识别

图像增强:图像裁切,图像超分,色彩迁移,风格迁移

图像分割:通用分割,人像分割,面部分割,头部分割,头发分割,商品分割

目标检测:主题检测,机动车检

效率平台

视觉智能领域能力技术相比其它AI类技术(语音语言等),功能流派更多,场景也更复杂 ,各种能力逻辑也存在互相包含的情况。阿里云视觉智能平台依靠整个阿里巴巴经济体的大量业务场景和应用实践(电商零售、金融物流、文娱营销、企业服务等多个行业),将复杂的视觉AI能力进行系统划分,形成最符合实践场景的AI能力系统,并通过平台进行统一输出,开发者可以轻松找到适用于自身研发需求和业务场景的能力,以最低的成本调用最匹配的AI能力进行视觉场景研发。
02.png

普惠三面

“使用门槛越来越低“
“使用人群越来越多“
“使用面越来越广“
阿里云视觉智能平台希望为视觉智能AI领域带来真正的普惠AI,将接入使用视觉AI门槛和成本降到最低,以整个阿里云最强的运维能力和技术为用户提供最高的价值。未来,阿里云视觉智能将集合更多视觉领域的AI能力,拓展更多成熟的使用场景,在图像识别,人脸识别,文字识别等视觉智能领域帮助开发者和企业实现研发为核心,创造为价值的普惠AI。

了解更多AI产品请戳https://vision.aliyun.com/
点击观看产品发布会https://developer.aliyun.com/live/1915
03.jpg

相关文章
|
人工智能 计算机视觉
HarmonyOS NEXT AI基础视觉服务-背景替换
这是一个基于AI基础视觉服务的背景替换案例,通过调用设备相册选择图片并智能分割主体,支持动态更换背景颜色。主要步骤包括:1) 导入模块与定义组件;2) 实现图片选择与格式转换;3) 使用`subjectSegmentation.doSegmentation`接口完成主体分割;4) 通过随机RGB值实现背景色动态更换。代码结构清晰,功能完整,适合学习AI图像处理技术。
HarmonyOS NEXT AI基础视觉服务-背景替换
|
存储 人工智能 数据安全/隐私保护
HarmonyOS NEXT AI基础视觉服务-人脸对比
这是一套基于AI基础视觉服务实现的人脸对比系统,用户可通过调用设备相册选择两张图片,系统将提取人脸特征并计算相似度,最终以结构化数据形式展示对比结果(如相似度值和是否为同一人)。代码涵盖模块导入、双图选择、图像处理、人脸对比核心逻辑及UI界面构建,支持异常处理与权限管理,确保功能稳定性和兼容性。适配场景包括身份验证、人脸匹配等,具有较高的实用价值。
HarmonyOS NEXT AI基础视觉服务-人脸对比
|
人工智能 云计算
阿里云与华五教学协同中心、超星集团联合发布高校AI实践通识课丨云工开物
5月24日,华五教学协同中心、阿里云与超星集团联合发布《高校AI实践通识课》。该课程融合理论与实践,由复旦大学等高校名师打造理论部分,阿里云提供AI实训平台支持实践环节,助力学生提升AI应用能力。课程预计秋季学期免费开放,推动AI时代人才培养。阿里云副总裁刘湘雯表示,这是AI与教育深度融合的创新实践;超星集团总裁史超强调,合作模式助力人才适应未来社会发展。此外,阿里云“云工开物”计划持续为高校提供技术支持与免费算力,助力AI教育发展。
|
人工智能 计算机视觉
HarmonyOS NEXT AI基础视觉服务-人脸识别
这是一个基于AI基础视觉服务的人脸识别案例,通过调用设备相册选择图片,利用MediaLibraryKit、ImageKit和CoreVisionKit等模块完成图像处理与人脸检测,并展示结构化结果。核心功能包括:相册访问授权、图像数据转换、人脸位置及特征点检测,最终以弹窗形式输出检测信息。代码涵盖模块导入、功能实现与UI构建,适合学习AI视觉应用开发流程。
|
11月前
|
机器学习/深度学习 人工智能 自然语言处理
AI Compass前沿速览:IndexTTS2–B站、HuMo、Stand-In视觉生成框架、Youtu-GraphRAG、MobileLLM-R1–Meta、PP-OCRv5
AI Compass前沿速览:IndexTTS2–B站、HuMo、Stand-In视觉生成框架、Youtu-GraphRAG、MobileLLM-R1–Meta、PP-OCRv5
866 10
AI Compass前沿速览:IndexTTS2–B站、HuMo、Stand-In视觉生成框架、Youtu-GraphRAG、MobileLLM-R1–Meta、PP-OCRv5
|
人工智能 文字识别 计算机视觉
HarmonyOS NEXT AI基础视觉服务-文字识别
本案例展示了一款基于AI基础视觉服务的文字识别应用,通过调用设备相机拍摄照片并识别图片中的文字内容。主要实现步骤包括:1) 导入所需功能模块;2) 调用相机获取图片URI;3) 将图片转换为可识别的像素图;4) 配置视觉识别参数并执行文字识别;5) 构建界面组件,实现拍照与结果显示交互。核心要点涵盖相机权限、图像格式兼容及结构化识别结果处理,完整代码整合了各功能模块的调用流程,确保功能顺畅运行。
|
存储 人工智能 安全
有奖体验 AI 模特换装,解锁电商视觉新体验
有奖体验 AI 模特换装,解锁电商视觉新体验
有奖体验 AI 模特换装,解锁电商视觉新体验
|
文字识别 算法 API
视觉智能开放平台产品使用合集之人脸数据库容量是否支持扩容
视觉智能开放平台是指提供一系列基于视觉识别技术的API和服务的平台,这些服务通常包括图像识别、人脸识别、物体检测、文字识别、场景理解等。企业或开发者可以通过调用这些API,快速将视觉智能功能集成到自己的应用或服务中,而无需从零开始研发相关算法和技术。以下是一些常见的视觉智能开放平台产品及其应用场景的概览。
375 3
|
存储 移动开发 数据库
视觉智能开放平台产品使用合集之人脸数据库容量是否支持扩容
视觉智能开放平台是指提供一系列基于视觉识别技术的API和服务的平台,这些服务通常包括图像识别、人脸识别、物体检测、文字识别、场景理解等。企业或开发者可以通过调用这些API,快速将视觉智能功能集成到自己的应用或服务中,而无需从零开始研发相关算法和技术。以下是一些常见的视觉智能开放平台产品及其应用场景的概览。
342 2
|
文字识别 算法 API
视觉智能开放平台产品使用合集之处理一张图片大概耗时多久
视觉智能开放平台是指提供一系列基于视觉识别技术的API和服务的平台,这些服务通常包括图像识别、人脸识别、物体检测、文字识别、场景理解等。企业或开发者可以通过调用这些API,快速将视觉智能功能集成到自己的应用或服务中,而无需从零开始研发相关算法和技术。以下是一些常见的视觉智能开放平台产品及其应用场景的概览。
398 1

热门文章

最新文章