深度学习训练,选择P100就对了
本文使用NVCaffe、MXNet、TensorFlow三个主流开源深度学习框架对P100和P40做了图像分类场景的卷积神经网络模型训练的性能对比,并给出了详细分析,结论是P100比P40更适合深度学习训练场景。
如何搭建直播平台?低延时连麦+人工智能让互动升级
通过集成阿里云直播SDK,用户可以轻松实现移动端、PC端的直播流推送。直播服务器接收到直播流,对流进行处理(转封装、转码等),并通过CDN进行分发。支持10万+路流输出,1000万+观众同时在线。本文将详细展开。
深度学习在语音识别中的声学模型以及语言模型的应用
目前深度学习在图像和语音识别等领域应用越来越广泛,比如图像处理类应用、视频归纳、智能客服,以及延伸的服务机器人领域、车载助手等,本文着重介绍深度学习在语音识别中声学模型与语言模型中的应用,如FSMN,LSTM,RNN等网络结构的设计,比传统的结构在效果上有巨大的提升
特定人语音唤醒简介
特定人语音唤醒,就是通过识别语音中所含的内容和人的身份信息,来实现特定人语音唤醒功能。这是一种较为新颖、具有一定安全性、便捷性和趣味性的功能,同时可以增强个性化体验。
高性能计算技术也能助推大规模深度学习(百度实践)
本文描写了百度硅谷人工智能实验室在深度学习框架中引入HPC技术的实践,通过对OpenMPI里ring all-reduce算法进行改进,使语音识别训练模型的性能得到数十倍的提升,最后百度开源了其实现,希望更多的人受益。
梦想照进现实 - AR/VR 篇 (作者:方如)
毋庸置疑,图像识别、三维感知与跟踪、人机交互和三维渲染是AR/VR 四个核心部分,从这些方面下功夫,在实战中做好技术积累,更好地实现新零售下的内容升级,为下一代的计算平台打基础。
在CES 2017大展上,Kino-mo公司的展台前面挤满了人。
中国移动:巨型传统客服中心智能化转型之路
摘要:AI大行其道的今天,在所有可自动化的领域中,客服服务无疑是自动化行业重要的目标之一。中国移动致力于利用最新技术更快更好的从过去传统导航升级为真正智能语音机器人导航,更期待对客户服务全链路进行优化,将呼叫中心从成本中心变成业务中心。