开发者社区
ModelScope模型即服务
语音
正文
有无语音分类的相关开源预训练模型推荐?主要是识别:御姐音、萝莉音、烟嗓、少年感 此类类似的
已经尝试了qwen-audio 7B 模型,对此类分类的识别准确率比较低,有无专门做这个的模型。
展开
收起
aliyun3025401976
2026-01-09 16:31:30
370
分享
版权
0
条回答
写回答
取消
提交回答
相关问答
支付宝H5 下载的时候,提示 【请确保该下载文件来源安全,如需浏览,请长按网址复制后使用浏览器访问】
298280
12
0
this xml file does not appear to have any style in
64924
11
0
购买阿里国外的云服务器是否可以访问谷歌?
96279
51
0
#支付宝 授权提示请在支付宝客户端打开链接
28635
19
0
com/action/joingroup?code=v1是什么意思
225819
21
0
基础语言百问-Python
71637
30
0
yyyy-MM-dd'T'HH:mm:ss.SSSZZ和yyyy-MM-dd'T'HH:mm:ss.
50093
10
0
访问ECS服务器的网站提示“由于你访问的URL可能对网站造成安全威胁,您的访问被阻断”,这是什么原因?
144656
17
0
什么是长期资源?
1419
1
0
无法通过web页面登陆邮箱
1375
1
0
ModelScope模型即服务
语音
包括语音识别、语音合成、语音唤醒、声学设计及信号处理、声纹识别、音频事件检测等多个领域
我要提问
相关文章
小结
构建智能客服:阿里云智能语音交互+函数计算的低成本方案
docker安装部署FunASR
【深度建议】打破设备壁垒:关于通义千问实现“全平台智能语音交互”与“知识闭环”的五大核心建议
阿里云智能语音交互完全对接指南:从开通服务到生产级集成
相关解决方案
更多
GLM-5.2:长任务时代开源旗舰模型
基于 Spark 和 PyTorch 的模型训练方案
OpenAI 重磅开源,快速部署GPT-OSS模型
告别低效沟通,使用大模型发起语音通话
一键训练模型及部署GPU共享推理服务
热门讨论
热门文章
目录空间都删的只剩2G了,还报OSError: [Errno 122] Disk quota exc
GPU相比CPU并没有明显提高uniasr语音识别和语音合成的推理速度
modelscope1.6.1的环境,本地报错似乎提示使用正确 modelscope版本
基于ModelScope进行推理,
运行报错AttributeError: 'HParams' object has no attrib
模型训练速度太慢
语音合成速度太慢,且无法并行
零门槛玩转AI声音定制,3分钟即可复刻你的发音模型
可以提供微调阶段的训练集吗?
pip安装语音领域模型依赖报错。
展开全部
docker安装部署FunASR
CosyVoice 2.0:阿里开源升级版语音生成大模型,支持多语言和跨语言语音合成,提升发音和音色等的准确性
百聆:集成Deepseek API及语音技术的开源AI语音对话助手,实时交互延迟低至800ms
FireRedASR:精准识别普通话、方言和歌曲歌词!小红书开源工业级自动语音识别模型
SpeechGPT 2.0:复旦大学开源端到端 AI 实时语音交互模型,实现 200ms 以内延迟的实时交互
Dolphin:40语种+22方言!清华联合海天瑞声推出的语音识别大模型,识别精度超Whisper两代
ClearerVoice-Studio:阿里通义开源的语音处理框架,提供语音增强、分离和说话人提取等功能
3D-Speaker:阿里通义开源的多模态说话人识别项目,支持说话人识别、语种识别、多模态识别、说话人重叠检测和日志记录
PaddleSpeech:百度飞桨开源语音处理神器,识别合成翻译全搞定
Kokoro-TTS:超轻量级文本转语音模型,支持生成多种语言和多种语音风格
展开全部
还有其他疑问?
咨询AI助理