云知声发布多模态AI战略,欲依托算法与芯片构建场景优势

简介: 云知声在北京召开新闻发布会,正式公布了其多模态AI芯片战略与规划,并同步曝光了在研的三款定位不同场景的AI芯片

雷锋网消息,当前我们正处于5G爆发的边缘,5G与AI的结合将真正促使AIoT智慧物联的落地与实现。可以预见的是,未来巨量的多维数据(如语音、图像、视频等)集中处理与边缘式分布计算的需求,将进一步挑战AI芯片的计算能力。

2019年1月2日,云知声在北京召开新闻发布会,正式公布了其多模态AI芯片战略与规划,并同步曝光了在研的三款定位不同场景的AI芯片。

AIoT造就AI芯片新形态

2018年,“多模态”逐渐成为了业界研究的一个重点。如果把模态理解为感官,那么多模态即是调用多种感官的交互方式,它跨过了自然语言,其方式也更加贴近人,是AI未来的一个发展方向。

TB1kNH2z9zqK1RjSZFpXXakSXXa.jpg

云知声创始人兼CEO黄伟认为,随着AIoT场景的逐渐丰富,未来应用对于端云互动有更强的需求,二者需要紧密结合,这要求对芯片设计和云端架构进行统一考量,具备多维度AI数据集中处理能力的多模态AI芯片将成必由之路。云知声接下来将依托AI算法与AI芯片构建场景优势,关键就在于多模态AI芯片战略。

基于此,云知声进一步对传统SoC(System on Chip)概念提出全新定义,其中S代表不同的AI服务能力即Skills,O代表云端与边缘侧的互动On/Off Cloud,C代表具备智能处理能力的AI芯片。

同时,云知声发布了DeepNet2.0多模态人工智能核心IP,其AI处理能力也从1.0的语音进化到2.0的多模态,支持语音、图像等处理能力。DeepNet2.0可兼容LSTM/CNN/RNN/TDNN等多种推理网络,支持可重构计算与Winograd处理,最高可配置算力达4Tops。目前云知声DeepNet2.0已在FPGA上得到验证,将在今年的全新多模态AI芯片海豚(Dolphin)上落地。

TB1Bs61zZbpK1RjSZFyXXX_qFXa.jpg

在会后的交流中,黄伟特别向雷锋网强调“多模态不是为了做视觉而做视觉,而是产品真正需要这种能力”。他以自动驾驶为例,可以通过面部图像识别司机注意力是否集中、是否疲劳驾驶,并根据识别结果提醒司机安全驾驶。“又如夜间行车时视野不如白天清晰,这时如果有实时图像增强的帮助就能大大提升安全性。”

多模态演进之路

作为一家国内领先的AI企业,云知声2014年开始切入物联网AI硬件芯片方案(IVM),并于2015年开始量产出货。在深入场景提供服务的过程中,为弥补通用芯片方案在给定成本和功耗条件下的能效比问题,以及在边缘算力、多模态AI数据处理方面的能力短板,2015年云知声正式启动自研AI芯片计划。

去年5月,云知声推出业内首款面向IoT的AI芯片UniOne及其解决方案雨燕(Swift),加速商业扩张与应用。该芯片采用云知声自主AI指令集,拥有具备完整自主知识产权的DeepNet1.0、uDSP(数字信号处理器),并支持DNN/LSTM/CNN等多种深度神经网络模型,性能较通用方案提升超50倍。

TB1HZ61zZbpK1RjSZFyXXX_qFXa.jpg

云知声联合创始人李霄寒曾指出,“UniOne不是一颗芯片,而是一系列芯片,它代表了云知声对于物联网AI芯片发展战略的整体构想”。在今天的发布会上,李霄寒再次从三方面论证了物联网多模态AI芯片的必要性。他认为,当前物联网产品线的AI芯片越来越明显地体现出三个趋势:

场景化:芯片设计正在由原来的片面追求PPA,即性能(Power)、功耗(Performance)和面积(Area),逐渐演变成基于软硬一体,甚至包括云端服务的方式来解决某个垂直领域的具体问题,芯片本身上升成为整个解决方案中的重要部分,而非唯一;

端云互动:在物联网的不同应用场景下,海量终端设备要实现功能智能化必须端云配合,即形成边缘算力和云端算力的动态平衡。端云互动的命题需要AI芯片的强有力支持,进一步也深刻影响到芯片的设计,以及最终的交付;

数据多模态:在以5G驱动的万物智联场景下,芯片所接触到的数据维度将由原来的单一化走向多元化,芯片所需处理的数据也由单模态变成多模态,这对芯片尤其是物联网人工智能芯片的设计提出了新的挑战。

以此来看,面向物联网终端场景的AI芯片核心是解决垂直场景问题的能力,其呈现形式将不再是一个单一的硬件,而是承载着边缘能力与云端能力的多模态AI软硬一体解决方案。

三款芯片蓄势待发

在首款量产芯片雨燕已有大批客户导入,占领市场先发优势的背景下,2019年云知声在芯片落地规划方面仍将保持积极态度。

TB18OIlz4naK1RjSZFBXXcW7VXa.jpg

李霄寒向雷锋网(公众号:雷锋网)透露,在持续迭代升级现有雨燕芯片的性能与服务之外,目前云知声多款面向不同方向的芯片也已在研发中,包括适用性更广的超轻量级物联网语音AI芯片雨燕Lite、可面向智慧城市场景提供对语音和图像等多模态计算支持的多模态AI芯片海豚(Dolphin),以及与吉利集团旗下生态链企业亿咖通科技共同打造的面向智慧出行场景的多模态车规级AI芯片雪豹(Leopard),三款芯片计划于2019年启动量产。

为实现多模态AI芯片的战略落地,目前云知声已在加速技术布局,并在机器视觉方面取得飞速进展。其中,面向机器视觉的轻量级图像信号处理器已可实现在不依赖外部内存的情况下,在30fps的速率下实时对传感器的图片进行预处理,以进一步提高后续机器视觉处理模块的处理速度和效果。

据悉,借助基于人脸信息分析的多模态技术,已可实现人脸/物体识别、表情分析、标签化、唇动状态跟踪等功能,可为产品交互和用户体验提供更多的可玩性和灵活性。

TB1xw_3z7voK1RjSZFDXXXY3pXa.jpg

此外,在图像与芯片技术的产学研合作方面,云知声还与杜克大学所领导的美国自然科学基金旗下唯一人工智能计算中心ASIC达成深度合作,致力于AI芯片算法压缩与量化技术,以及非冯·诺依曼架构的新型AI芯片计算架构研究,将进一步为云知声多模态AI芯片战略的推进夯实基础。

目前,依托在家居、车载等真实场景下丰富的产品经验,以及具备先发优势的AI芯片能力,云知声将业务覆盖到包括智能家居、智能汽车、智能儿童机器人、智慧酒店、智慧交通等诸多场景。未来云知声将持续发力多模态AI芯片,不断拓展技术与场景生态,以实现面向未来AIoT时代的全面赋能。

相关实践学习
钉钉群中如何接收IoT温控器数据告警通知
本实验主要介绍如何将温控器设备以MQTT协议接入IoT物联网平台,通过云产品流转到函数计算FC,调用钉钉群机器人API,实时推送温湿度消息到钉钉群。
阿里云AIoT物联网开发实战
本课程将由物联网专家带你熟悉阿里云AIoT物联网领域全套云产品,7天轻松搭建基于Arduino的端到端物联网场景应用。 开始学习前,请先开通下方两个云产品,让学习更流畅: IoT物联网平台:https://iot.console.aliyun.com/ LinkWAN物联网络管理平台:https://linkwan.console.aliyun.com/service-open
目录
相关文章
|
4天前
|
人工智能 开发框架 决策智能
谷歌开源多智能体开发框架 Agent Development Kit:百行代码构建复杂AI代理,覆盖整个开发周期!
谷歌开源的Agent Development Kit(ADK)是首个代码优先的Python工具包,通过多智能体架构和灵活编排系统,支持开发者在百行代码内构建复杂AI代理,提供预置工具库与动态工作流定义能力。
77 3
谷歌开源多智能体开发框架 Agent Development Kit:百行代码构建复杂AI代理,覆盖整个开发周期!
|
10天前
|
人工智能 自然语言处理 算法
阿里云 AI 搜索开放平台:从算法到业务——AI 搜索驱动企业智能化升级
本文介绍了阿里云 AI 搜索开放平台的技术的特点及其在各行业的应用。
|
22天前
|
人工智能 数据可视化 API
36.7K star!拖拽构建AI流程,这个开源LLM应用框架绝了!
`Flowise` 是一款革命性的低代码LLM应用构建工具,开发者通过可视化拖拽界面,就能快速搭建基于大语言模型的智能工作流。该项目在GitHub上线不到1年就斩获**36.7K星标**,被开发者誉为"AI时代的乐高积木"。
124 8
|
3天前
|
人工智能 算法 API
多模态模型卷王诞生!InternVL3:上海AI Lab开源78B多模态大模型,支持图文视频全解析!
上海人工智能实验室开源的InternVL3系列多模态大语言模型,通过原生多模态预训练方法实现文本、图像、视频的统一处理,支持从1B到78B共7种参数规模。
75 6
多模态模型卷王诞生!InternVL3:上海AI Lab开源78B多模态大模型,支持图文视频全解析!
|
17天前
|
机器学习/深度学习 人工智能 JSON
OPPO联合港科大推出多模态推理优化框架 OThink-MR1:让AI学会『举一反三』,几何推理准确率暴增
OThink-MR1是OPPO与港科大联合研发的多模态优化框架,通过动态KL散度策略和奖励模型显著提升模型在视觉计数等复杂任务中的泛化能力。
70 20
OPPO联合港科大推出多模态推理优化框架 OThink-MR1:让AI学会『举一反三』,几何推理准确率暴增
|
20天前
|
机器学习/深度学习 人工智能 搜索推荐
AutoGLM沉思:智谱AI推出首个能"边想边干"的自主智能体!深度研究+多模态交互,颠覆传统AI工作模式
AutoGLM沉思是由智谱AI推出的一款开创性AI智能体,它突破性地将深度研究能力与实际操作能力融为一体,实现了AI从被动响应到主动执行的跨越式发展。
151 16
AutoGLM沉思:智谱AI推出首个能"边想边干"的自主智能体!深度研究+多模态交互,颠覆传统AI工作模式
|
13天前
|
人工智能 算法 安全
OpenRouter 推出百万 token 上下文 AI 模型!Quasar Alpha:提供完全免费的 API 服务,同时支持联网搜索和多模态交互
Quasar Alpha 是 OpenRouter 推出的预发布 AI 模型,具备百万级 token 上下文处理能力,在代码生成、指令遵循和低延迟响应方面表现卓越,同时支持联网搜索和多模态交互。
126 1
OpenRouter 推出百万 token 上下文 AI 模型!Quasar Alpha:提供完全免费的 API 服务,同时支持联网搜索和多模态交互
|
3天前
|
存储 人工智能 自然语言处理
15.4K Star!Vercel官方出品,零基础构建企业级AI聊天机器人
"基于Next.js 14和AI SDK打造的Chat SDK,让开发者快速构建支持多模态交互、代码执行、文件共享的智能对话系统,5分钟完成全栈部署!" —— Vercel AI Chatbot项目核心宣言
|
14天前
|
存储 监控 算法
员工电脑监控场景下 Python 红黑树算法的深度解析
在当代企业管理范式中,员工电脑监控业已成为一种广泛采用的策略性手段,其核心目标在于维护企业信息安全、提升工作效能并确保合规性。借助对员工电脑操作的实时监测机制,企业能够敏锐洞察潜在风险,诸如数据泄露、恶意软件侵袭等威胁。而员工电脑监控系统的高效运作,高度依赖于底层的数据结构与算法架构。本文旨在深入探究红黑树(Red - Black Tree)这一数据结构在员工电脑监控领域的应用,并通过 Python 代码实例详尽阐释其实现机制。
37 6
|
10天前
|
人工智能 数据可视化 关系型数据库
23.5K star!零代码构建AI知识库,这个开源神器让问答系统开发像搭积木一样简单!
FastGPT 是一个基于大语言模型的智能知识库平台,提供开箱即用的数据处理、RAG检索和可视化AI工作流编排能力,让你无需编写代码就能轻松构建复杂的问答系统!