Python用ctypes调用动态库的方式使用科大讯飞语音识别-阿里云开发者社区

Python用ctypes调用动态库的方式使用科大讯飞语音识别

2019-05-08 1962

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： ctypes 是 Python 的一个模块，它提供了C语言相关的数据类型，可以方便的调用C语言编写的DLL（Windows 动态链接库）和so（Linux动态链接库）。科大讯飞的语音识别客户端SDK提供了Linux下的C语言SDK，却没有Python的。

ctypes 是 Python 的一个模块，它提供了C语言相关的数据类型，可以方便的调用C语言编写的DLL（Windows 动态链接库）和so（Linux动态链接库）。科大讯飞的语音识别客户端SDK提供了Linux下的C语言SDK，却没有Python的。有了ctypes，我们就可以很轻松的用Python来使用科大讯飞的语音识别了。

b50e784be9117ccc5f008fdd45679e52fb7

通过LoadLibrary()函数加载动态库：

xflib = ctypes.cdll.LoadLibrary('msc/libmsc.so')

在Python里面调用C函数时主要是注意参数的类型。语音识别的接口的具体参数可以参考其提供的文档，比如接口函数：

const char* MSPAPI QISRSessionBegin( const char* grammarList, const char*
params, int* errorCode )

返回的是一个char指针作为sessionID以供后续接口作为参数使用，在Python里面要用ctypes.c_voidp类型：

ret = ctypes.c_int()
sessionId = ctypes.c_voidp()
sessionId = xflib.QISRSessionBegin(None, param1, ret)

调用其它接口函数时，还可能用到如下ctypes的类型和接口：

ctypes.create_string_buffer()
ctypes.addressof()
ctypes.byref()
ctypes.string_at()
ctypes.c_char_p()
ctypes.c_uint()

关于ctypes的更详细说明可以参考官方文档。

文章来源于：猿人学网站的python教程。
版权申明:若没有特殊说明，文章皆是猿人学原创，没有猿人学授权，请勿以任何形式转载。

相关实践学习

达摩院智能语音交互 - 声纹识别技术

声纹识别是基于每个发音人的发音器官构造不同，识别当前发音人的身份。按照任务具体分为两种：声纹辨认：从说话人集合中判别出测试语音所属的说话人，为多选一的问题声纹确认：判断测试语音是否由目标说话人所说，是二选一的问题（是或者不是）按照应用具体分为两种：文本相关：要求使用者重复指定的话语，通常包含与训练信息相同的文本（精度较高，适合当前应用模式）文本无关：对使用者发音内容和语言没有要求，受信道环境影响比较大，精度不高本课程主要介绍声纹识别的原型技术、系统架构及应用案例等。讲师介绍：郑斯奇，达摩院算法专家，毕业于美国哈佛大学，研究方向包括声纹识别、性别、年龄、语种识别等。致力于推动端侧声纹与个性化技术的研究和大规模应用。

Python用ctypes调用动态库的方式使用科大讯飞语音识别

热门文章

最新文章

相关课程

相关电子书

相关实验场景

推荐镜像

热门

活动广场

任务中心

开发者评测

高校计划

乘风者计划

训练营

阿里云MVP

话题

直播

下载

镜像站

技术资料

插件

Python用ctypes调用动态库的方式使用科大讯飞语音识别

热门文章

最新文章

相关课程

相关电子书

相关实验场景

推荐镜像