产品推荐 | 理想的语音大脑是什么样?来看看华镇VB590标准核心板

简介: 日前,华镇语音大脑VB590标准核心板已在OCC上线。该方案针对语音芯片行业应用场景的碎片化、推广周期长,应用场景复杂,缺乏统一语音标准等痛点,推出语音大脑VB590标准核心板,可广泛应用在智能家居,智能卫浴,智能照明,智能机电,智能玩具等场景领域。

日前,华镇语音大脑VB590标准核心板已在OCC上线。该方案针对语音芯片行业应用场景的碎片化、推广周期长,应用场景复杂,缺乏统一语音标准等痛点,推出语音大脑VB590标准核心板,可广泛应用在智能家居,智能卫浴,智能照明,智能机电,智能玩具等场景领域。

方案介绍

VB590标准核心板,采用高灵敏度模拟麦克风录音,利用稳态、动态噪音过滤算法,动态调整录音音量,录音降噪后通过语音增强,将高信噪比的语料数据送到识别引擎去做识别,保证了不同距离识别的高精准度和抗噪能力,适合远距离或嘈杂环境下真实复杂场景下的语音识别、语音控制。系统无需WiFi、无需APP并识别灵敏,内置VB590AI语音识别芯片,用于极速语音操控能力,用户可以通过语音实现和设备的交互控制,带来简单快捷的使用体验。

针对离线语音识别客制化程度高的特点,VB590方案实现SDK完全开放,自定义语音识别指令集,开发者可以连接华镇服务器训练对应的语音模型。训练方法简便,通过文本编辑的方式,就可以实现包括唤醒词在内的针对不同客户的语音模型。

四大优势让家庭控制更加智能化

【语音识别AI算法】基于第二代TDNN-LFMMI模型,识别率较第一代DNN-HMM 模型有巨大优势,提高6%以上。

【多语种声学模型】具备中文普通话、北美英语、英式英语的识别能力,能够覆盖绝大多数带方言的普通话识别场景。中文模型包括了近2万小时,英文模型包括了近1万小时。

【前端声学处理算法】支持语音增强、语音降噪、实现单麦远场识别。

【客制化服务】SDK完全开放,提供自定义识别指令集, 开发者可以连接华镇服务器训练对应的语音模型。

94C90BB1-3C04-4b9a-8E1B-949BCABC82CC.png

芯片方面

VB590采用了平头哥高性能32位处理器XT804。芯片上运行语音识别算法、语音降噪算法、语音增强算法实现了远场离线语音识别。芯片内置语音识别神经网络计算所需要的DSP指令增强单元以及MCA算法硬件加速器,AI算法与芯片架构深度融合,算力和效能之间取得非常好的平衡。

VB590芯片内置集成了128KB SRAM、2MB FlASH、ADC、DAC,外围BOM极其简单。芯片支持中文、英文离线语音指令识别、远场识别、强噪音下识别,完全是高性价比离线识别芯片同时还支持二次开发,开发者可以自定义语音识别指令,从研发到量产,提供全流程服务。

此款产品已在OCC上线,更多产品详情可扫描下方二维码查看。

C9576F8F-26C0-49b1-AF2E-EC652899C7F9.png

公司介绍

上海华镇电子科技有限公司成立于2006年,拥有近百项专利及软件著作权。是国家高新技术企业,软件企业并连续多年获得上海市双创大赛奖项,华镇拥有多项人工智能核心算法,如:声学前端的麦克风阵列(SMA)、远声降噪(NS)、回声抑制(AEC)、人工智能深度神经网络语音识别(KWS、ASR)、声纹识别(VPR)等核心算法,有着丰富的研究及项目落地的经验。华镇聚合核心算法能力推出全方位赋能百业的人工智能开放平台——语音大脑VoiceBrain开放平台,作为软硬件全链条能力的企业,华镇可以为客户提供一站式Turnkey服务,让我们的合作伙伴用最小的成本,简单、便捷的用上AI系统。

相关实践学习
达摩院智能语音交互 - 声纹识别技术
声纹识别是基于每个发音人的发音器官构造不同,识别当前发音人的身份。按照任务具体分为两种: 声纹辨认:从说话人集合中判别出测试语音所属的说话人,为多选一的问题 声纹确认:判断测试语音是否由目标说话人所说,是二选一的问题(是或者不是) 按照应用具体分为两种: 文本相关:要求使用者重复指定的话语,通常包含与训练信息相同的文本(精度较高,适合当前应用模式) 文本无关:对使用者发音内容和语言没有要求,受信道环境影响比较大,精度不高 本课程主要介绍声纹识别的原型技术、系统架构及应用案例等。 讲师介绍: 郑斯奇,达摩院算法专家,毕业于美国哈佛大学,研究方向包括声纹识别、性别、年龄、语种识别等。致力于推动端侧声纹与个性化技术的研究和大规模应用。
相关文章
|
6月前
|
编解码 监控 API
惊艳登场!揭秘如何在Android平台上轻松玩转GB28181标准,实现多视频通道接入的超实用指南!
【8月更文挑战第14天】GB28181是公共安全视频监控联网的技术标准。本文介绍如何在Android平台上实现该标准下的多视频通道接入。首先准备开发环境,接着引入GB28181 SDK依赖并初始化SDK。实现设备注册与登录后,通过指定不同通道号请求多路视频流。最后,处理接收到的数据并显示给用户。此过程涉及视频解码,需确保应用稳定及良好的用户体验。
171 0
|
JavaScript 前端开发 测试技术
研发思维06----嵌入式智能硬件量产过程性设计(下)
研发思维06----嵌入式智能硬件量产过程性设计
365 0
研发思维06----嵌入式智能硬件量产过程性设计(下)
|
JavaScript 智能硬件
研发思维06----嵌入式智能硬件量产过程性设计(上)
嵌入式智能硬件产品从EVT到MP过程分析
212 0
研发思维06----嵌入式智能硬件量产过程性设计(上)
|
机器学习/深度学习 自然语言处理 达摩院
任务驱动型人机对话|学习笔记
快速学习任务驱动型人机对话
任务驱动型人机对话|学习笔记
|
机器学习/深度学习 自然语言处理 达摩院
任务驱动型人机对话|学习笔记
快速学习任务驱动型人机对话
任务驱动型人机对话|学习笔记
|
机器学习/深度学习 人工智能 自然语言处理
科大讯飞的1024:语音技术进一步突破,发布专用芯片
1024 作为程序员的节日被世人所知,而科大讯飞也会在每年这个时候举办开发者节日和相关活动。在今年的开发者节上,科大讯飞发布了更多关于平台,产品和技术方面的信息。
562 0
科大讯飞的1024:语音技术进一步突破,发布专用芯片
|
物联网 Linux 芯片
启明云端分享:基于工业级嵌入式核心板卡制作而成的核心模块
WT-ARM9X25-S2 核心模块是基于 ATMEL AT91SAM9X25 ARM9 处理器的工业级嵌入式核心板卡,采用表贴式邮票口封装, 4cm X 4cm 超小尺寸, 108 引脚。该产品主要面向工业控制,仪表仪器,医疗电子,物联网网关等应用, 可以帮助客户快速开发高可靠性产品。
207 0
启明云端分享:基于工业级嵌入式核心板卡制作而成的核心模块
|
机器学习/深度学习 人工智能 算法
产品推荐 | 理想的语音大脑是什么样?来看看华镇VB590标准核心板
日前,华镇语音大脑VB590标准核心板已在OCC上线。该方案针对语音芯片行业应用场景的碎片化、推广周期长,应用场景复杂,缺乏统一语音标准等痛点,推出语音大脑VB590标准核心板,可广泛应用在智能家居,智能卫浴,智能照明,智能机电,智能玩具等场景领域。
产品推荐 | 理想的语音大脑是什么样?来看看华镇VB590标准核心板
|
人工智能 算法 语音技术
牵手理想,地平线如何为理想ONE打造精准全车语音交互
在今年年内交付的理想ONE车内,用户可体验到地平线AI赋能的车内智能交互系统。
1275 0
对话赛灵思Gilles Garcia:深度糅合技术属性与客户需求,做极致的Xilinx式服务
因为对技术的持续追求与钻研以及可编程芯片特有的灵活性,赛灵思能够在变幻莫测的市场环境中以不变应万变,深入到各行各业的应用创新中。
379 0