Window本地部署ChatTTS

简介: 这篇文章详细介绍了如何在Windows系统上本地部署ChatTTS,实现将文本转化为高质量的语音输出,并提供了简便的部署方法和使用指南。

之前的大模型介绍一直停留在文字交互上,这节部署一个ChatTTS实现文字转语音,而且语音十分接近真人,是最近比较热的一个文字转语音的开源项目了。此前我在window上部署过一次,部署成功了,但是过程稍微复杂些,官网提供的部署方法更适合liunx系统,对window不友好,但如果有liunx系统可以参考尝试下。下面我用一个非常简单的方式来部署,是一个封装好各种包的部署包。

不过官网提供了在线体验的功能非常棒,

首先下载改进后的包,如果需要包的下载地址可以私信我或者给我留言,下载好后解压到文件夹,目录结构如下,

然后,你只需要双击app的那个文件就可以运行了,因为这个包里已经包含了必要的组件,双击运行后会出现如下的日志,最终打印出来一个启动地址,在浏览器输入地址后就可以打开主页面了。

首页中上面是输入要转化的文本,下面是音色提示词以及数字转文本等参数,可以每次修改一个值尝试下效果。选择不同的音色或者音色值转化后的人语音是不一样的,需要注意的是如果文本中存在数字要勾选数字转文本,否则语音会读不准数字的发音。完成后点击立即合成声音就可以生成了,生成完毕声音会显示在下面,点击就可以播放了,

这个版本虽然对原始的chatTTS做了一些修改,但是还提供了API调用的功能,点击生成的语音下显示API调用就可以看到调用的接口文档了。

可以根据接口文档,传入参数值,尝试下。

相关文章
|
2月前
|
人工智能 自然语言处理 数据安全/隐私保护
阿里云百炼Token Plan订阅计划支持哪些AI模型?千问 / DeepSeek / 万相全模型清单共11款
阿里云百炼Token Plan订阅计划聚合11款主流AI模型,涵盖通义千问、DeepSeek、智谱GLM及万相、HappyHorse等多模态模型,支持文本、图像、音视频生成。提供Lite个人版(39元/月)与企业标准席位(150元起),享qwen3.8-preview 1折、夜间qwen3.7系列2折等限时优惠。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
766 1
|
6月前
|
弹性计算 Linux API
本地离线语音转文字全攻略:OpenClaw 阿里云/本地部署与免费大模型API配置+OpenAI Whisper实战指南
在日常办公、内容创作与数据处理场景中,语音转文字已经成为提升效率的核心工具。会议录音整理、视频字幕生成、播客内容提炼、采访记录归档等需求日益普遍,而传统在线转录工具存在隐私泄露风险、付费成本高、文件大小受限、网络依赖强等问题。OpenAI开源的Whisper模型凭借免费、本地运行、多语言支持、高准确率等优势,成为个人与小型团队的首选方案。结合OpenClaw技能管理平台,可实现一键调用、批量处理、跨设备协同,进一步降低使用门槛。本文将全面讲解Whisper核心用法、2026年阿里云ECS部署OpenClaw流程、MacOS/Linux/Windows11本地部署步骤、阿里云百炼API与免费Co
2923 3
|
7月前
|
监控 搜索推荐 应用服务中间件
‌301重定向完全指南:从原理到生产级实践
301重定向是HTTP永久性跳转机制,用于旧URL迁移至新地址。核心价值:①SEO权重传递(90–99%);②保障用户体验,避免404;③统一URL规范(域名/协议/路径)。适用场景包括域名更换、HTTPS升级、结构优化等。Nginx、Apache及WordPress插件均可高效实现。(239字)
2554 2
|
XML 测试技术 API
利用C#开发ONVIF客户端和集成RTSP播放功能
利用C#开发ONVIF客户端和集成RTSP播放功能
5106 123
|
数据采集 人工智能 并行计算
惊了!Hugging Face 这款开源 TTS 能情感自由切换,Parler‑TTS 斩获 5.3K star,支持 34 角色+实时风格自定义,开源 TTS 新标杆
Hugging Face 开源轻量级 TTS 模型 Parler-TTS,支持情感自由切换、34 种说话人选择及实时风格自定义。提供 Mini 与 Large 两个版本,训练数据丰富,生成语音自然高质量,适配多种应用场景,助力高效语音开发。
964 1
|
人工智能 物联网 PyTorch
ChatTTSPlus:开源文本转语音工具,支持语音克隆,是 ChatTTS 的扩展版本
ChatTTSPlus 是一个开源的文本转语音工具,是 ChatTTS 的扩展版本,支持语音克隆、TensorRT 加速和移动模型部署等功能,极大地提升了语音合成的性能和灵活性。
1552 5
ChatTTSPlus:开源文本转语音工具,支持语音克隆,是 ChatTTS 的扩展版本
|
8月前
|
JSON API 网络架构
什么是API?API有哪些类型?
本文深入浅出地讲解API的概念、类型及应用。API即应用程序接口,是软件间通信的桥梁。文章从开放、内部、合作伙伴API等分类入手,解析REST、SOAP、GraphQL等技术类型,并探讨其在数据与功能调用中的作用,帮助读者全面理解现代数字服务的底层逻辑。
14480 10
|
机器学习/深度学习 人工智能 自然语言处理
Dolphin:40语种+22方言!清华联合海天瑞声推出的语音识别大模型,识别精度超Whisper两代
Dolphin是清华大学与海天瑞声联合研发的语音识别大模型,支持40种东方语言和22种中文方言,采用CTC-Attention混合架构,词错率显著低于同类模型。
5907 50
Dolphin:40语种+22方言!清华联合海天瑞声推出的语音识别大模型,识别精度超Whisper两代
|
弹性计算 语音技术
快速部署 ChatTTS 社区版
ChatTTS是专为对话场景设计的语音生成模型,特别适用于大型语言模型(LLM)助手的对话任务,以及诸如对话式音频和视频介绍等应用。它支持中文和英文,通过使用大约100,000小时的中文和英文数据进行训练,ChatTTS在语音合成中表现出高质量和自然度。本文介绍通过计算巢快速部署 ChatTTS 服务 。
快速部署 ChatTTS 社区版
|
算法 机器人 语音技术
由通义千问驱动的人形机器人具身智能Multi-Agent系统
申昊科技人形机器人小昊,集成通义千问多模态大模型的具身智能系统,旨在讲解销售、迎宾表演等场景。机器人通过语音、动作等方式与用户互动,利用云端大语言模型处理自然语言,结合视觉、听觉等多模态感知技术,实现流畅的人机对话、目标追踪、展厅讲解等功能。
2114 4
由通义千问驱动的人形机器人具身智能Multi-Agent系统

热门文章

最新文章