CloneTTS语音引擎v0.7.0 最新版

CloneTTS语音引擎v0.7.0 最新版

时间:2026-08-29 22:37

大小:274.2M

系统:Android

语言:中文

点击下载
  • CloneTTS语音引擎截图0
  • CloneTTS语音引擎截图1
  • CloneTTS语音引擎截图2
  • CloneTTS语音引擎截图3
  • 新发现的一款非常好用的原生轻松理级文字转语言tts引擎,CloneTTS安卓最新免费版,支持离线发音人提取,没有任何门槛直接使用,可以快速克隆与双擎系统全局听书,功能很全面,简洁好用易用,有兴趣的欢迎免费下载。

    CloneTTS语音引擎最新动态

    CloneTTS语音引擎迎来重大更新,在功能与体验上实现双重飞跃。全新升级的语音克隆算法,将声音复刻的相似度与自然度提升至新高度,仅需数秒样本即可生成极具表现力的个性化音色。推理速度大幅优化,实时合成延迟显著降低,让对话与创作场景更加流畅自如。此外,新增的韵律控制与情感调节模块,让用户能够精细调整语速、停顿及情绪色彩,赋予语音更丰富的情感层次。我们积极吸纳社区反馈,重构了音频编辑界面,操作更直观,批处理与音色管理功能也更加高效。同时,修复了部分环境下的兼容性问题,全面提升了稳定性。感谢每一位用户的建议与支持,CloneTTS将持续进化,为创作与交流带来更真实、更动人的声音体验。

    CloneTTS语音引擎

    CloneTTS语音引擎最新动态

    重点优化了多语种合成流畅度,新增“情感语调”调节滑块,可精细控制语速、音高与情绪色彩。同时修复了长文本断句不自然的问题,并大幅降低推理延迟,实现实时响应。用户反馈中备受期待的“自定义说话人克隆”功能已进入内测,社区用户普遍称赞音质清晰度提升30%以上,口型同步精度显著改善。欢迎通过官网下载体验。

    CloneTTS语音引擎

    CloneTTS语音引擎怎么创建音色

    1、下载安装好软件,打开后点右上角三个点选择添加音色。

    CloneTTS语音引擎

    2、同意并继续隐私合规声明。

    CloneTTS语音引擎

    3、在新建克隆音色中,选择参照素材。

    CloneTTS语音引擎

    4、设置特征参数与反注,然后点保存并启用。

    CloneTTS语音引擎

    5、创建好后在音色管理库中可以查看。

    CloneTTS语音引擎

    CloneTTS语音怎么调整发音语调

    添加发音替换规则:如果你发现某个字一直念反了或有特殊读音需求,到 “发音规则” 界面点击右上角 “⋮” -> “新添规则”,支持纯文本和正则表达式替换。

    CloneTTS语音引擎

    系统级纠错大词库:对于大量的多音字大批量错音,您可以在 “高级设置” 选项卡点击 “系统级纠错大词库”,手动选取并导入第三方的 system_dict.json 强正则补充外挂。

    高阶断句正则配置:这个选项决定了引擎切分长句时的停顿感(逗点、句号间断)。点击修改自定义。如果配置出现紊乱,可在此弹窗内点击 “恢复系统默认” 一键重置。

    怎么在朗读app中使用CloneTTS语音

    模式 1:接管系统 TTS(兼容性最广) 在手机的“设置”中,搜索 “TTS 设置”(或文字转语音输出),将默认引擎改为 CloneTTS。随后在“开源阅读”等应用中点击“朗读”即可生效,完美支持无级调速体验。

    模式 2:HTTP API 模式(应对极速免停顿) 切换到 “高级设置” 界面并打开首行的 “本地 HTTP API 服务”。将记录下的接口地址(如 http://127.0.0.1:8080/api/tts?text={{speakText}})完整填入外部阅读软件(如 Legado)的网络发音设置中即可。

    HTTP API 接口使用说明

    核心接口定义

    GET http://127.0.0.1:8080/api/tts

    参数说明:

    text (必填): 需要被朗读的文本内容。

    voice (可选): 指定要使用的发音人的 id(UUID 格式)。如果不传此参数,引擎将使用 App 内部当前选中的默认音色。

    speed (可选): 播放语速,默认为 1.0。目前支持接入外部软件传来的倍速参数。

    调用示例(浏览器或代码请求)

    GET http://127.0.0.1:8080/api/tts?voice=d73ca9c9-c132-4a5b-9f85-825fbaa07162&speed=1.2&text=你好,这是一段测试语音。

    在“开源阅读”(Legado) 中的配置变量写法

    如果您想单独手动配置某个发音人,URL 的占位符可以按如下标准写:

    http://127.0.0.1:8080/api/tts?voice=您的音色ID&speed={{speakSpeed / 10.0}}&text={{speakText}}

    更简便的做法(一键拉取全部)

    在绝大多数情况下,您完全不需要手动配置上述参数!

    只需要在“开源阅读”的“朗读引擎”中点击右上角菜单选择“网络导入”,填入以下集束接口地址:

    http://127.0.0.1:8080/api/legado/all

    开源阅读便会一键拉取并且自动配置好您 CloneTTS App 内的所有音色,开箱即用!

    为什么选择CloneTTS

    多音色支持

    新增 API 级别的多音色调用支持。外部阅读软件(如开源阅读、MultiTTS等)可以通过网络 API 接口传入 voice 参数,实现不同角色的分配发音。

    App 内“音色管理库”支持长按多选音色,选中后引擎将简单地按顺序交替发音。

    优化了底层引擎调度架构,解决了系统 TTS 与 HTTP API 抢占内存引起的应用崩溃问题,提升了应用的启动速度。

    HTTP API 扩展支持

    网络接口增加 voice 参数,用于指定发音人。

    网络接口增加 speed 参数,支持外部软件通过 URL 参数动态调节语速。

    音色环境迁移与导入支持

    增加了“追加合并”和“彻底覆盖”两种音色导入模式。

    修复了跨设备导入时因绝对路径不兼容导致的找不到音频文件的问题。现在导入时会根据当前系统环境自动重新映射路径。

    编辑支持修改推理步数 (num_steps)

    在音色的编辑弹窗中,新增了修改算力精度(推理步数 num_steps)的选项。

    更新日志

    0.7.0更新

    NPU 加速(全新)

    骁龙 8 Gen 2 / 8 Gen 3 / 8 至尊版 / 8 至尊版 Gen 5 端侧 NPU 合成,速度约 CPU 的 2 倍,发热更低。不支持时自动回退 CPU。

    分句引擎升级

    停顿按标点分级,对话不截断,中英混排不切碎。

    修复

    HTTP API 翻页首句杂音。

    无文件管理器机型崩溃。

    Android 12+ 后台 HTTP Server 崩溃。

    快速播放/停止竞态崩溃。

    其他

    参考音频建议 ≤ 8 秒。

    极速模型停止新下载(NPU 替代)。

    完全兼容,可直接覆盖安装。

    0.6.4更新

    完善 BGM/SFX 体验:修复 [sfx:事件] 触发稳定性,支持 MP3/OGG/FLAC,内置示例音效与页内试听,并补齐 BGM/SFX 分组子目录的递归识别。

    完善手动 BGM 与映射流程:支持独立手动播放、重启后恢复、修复开关首次点击不生效问题,并新增 SFX 映射独立导入/导出。

    新增一键全量备份/恢复:音色、规则、Ambience 配置、多角色数据与关键设置可一次打包迁移。

    新增 Local 共存机制、界面语言切换和设置内性能测试入口。

    优化音色管理与测试控制台:新建音色可直接设置 alias,测试控制台按当前分组筛选音色,恢复多条试音预设,并保留自定义文本。

    0.4.0更新

    修复了后台保存配置时可能因进程被杀导致参数丢失的问题。

    修复了“追加合并”导入后,因读取旧缓存导致界面没有及时显示新音色的问题。

    分发网络源配置给外部软件时,增加了哈希后缀机制,修复了向第三方软件批量导入时由于 ID 冲突导致只导入成功一个的问题。

    小编推荐同类软件

    • 微软Azure TTS:真人级多语种云端语音合成

    • 科大讯飞语音合成:中文自然度业界领先

    • 百度语音合成:免费额度多,接入简单

    • Google Cloud TTS:WaveNet技术音质极高

    • Amazon Polly:支持SSML精细控制发音

    • ElevenLabs:情感表达最逼真的语音克隆

    • Resemble AI:实时声音定制与克隆

    • Play.ht:在线快速生成主播级语音

    • VocaliD:专为有声读物优化情感

    • iFlytek TTS:深厚中文语音技术积累

    CloneTTS语音引擎特别说明

    v0.7.0为最新版,安装前请确保系统已安装Python 3.9+及FFmpeg。首次运行需联网下载基础模型(约2GB),建议使用稳定网络。克隆音色时,请提供5-10秒清晰人声(无背景音乐/噪音),过长或过杂的音频将降低克隆质量。若遇"CUDA out of memory",请降低batch_size或在设置中启用CPU模式(速度较慢但稳定)。常见问题:合成音频有杂音时,请检查输入文本是否含特殊符号,并确认采样率设置为22050Hz。安装技巧:建议使用虚拟环境(venv或conda)避免依赖冲突;若下载模型失败,可手动将模型文件放入`models/`目录。注意:本引擎仅支持中文、英文及中英混合合成,不支持多说话人实时对话。遇到异常报错,请先升级至最新版并重启服务。

    你可能感兴趣的

    猜你喜欢

      语音引擎TTS软件

      语音引擎TTS软件

      看文字小说看太久眼睛会酸疼,这时我们可以使用语音引擎TTS软件将手机上文字小说阅读出来,解放眼睛用耳朵来听,精品下载站小编特意整理了几款非常好用的语音引擎TTS软件给大家,下载软件安装到手机上后,可以借助TT..
      进入专区>>

      更多专题

      大家都在玩

      网友留言默认

      头像头像头像头像
      香港 网友 2026/6/20 20:36:38
      下载试了一下,挺上头的!操作简单直接,随便录几句就能克隆声音,离线也能用,比我之前用的那些方便多了。听书功能也丝滑,不卡顿,平时躺床上听小说太合适了,纯纯休闲神器,推荐试试

      Windows 10支持( 0 ) 盖楼(回复)

      查看更多评论

      本类排行榜

      其他版本