<?xml version="1.0" encoding="utf-8"?>
<rss version="2.0">
  <channel>
    <title>前沿AI软件资源与资讯 - AI语音</title>
    <link>https://deepface.cc/forum-20-1.html</link>
    <description>Latest 20 threads of AI语音</description>
    <copyright>Copyright(C) 前沿AI软件资源与资讯</copyright>
    <generator>Discuz! Board by Comsenz Inc.</generator>
    <lastBuildDate>Fri, 04 Sep 2026 06:22:22 +0000</lastBuildDate>
    <ttl>60</ttl>
    <image>
      <url>https://deepface.cc/static/image/common/logo_88_31.gif</url>
      <title>前沿AI软件资源与资讯</title>
      <link>https://deepface.cc/</link>
    </image>
    <item>
      <title>Breeze TTS 2：一句话设计声音，支持自由情感控制，克隆、设计、导演三合一</title>
      <link>https://deepface.cc/thread-1126-1-1.html</link>
      <description><![CDATA[Breeze TTS 2 是一个开源的文本转语音（TTS）模型，支持语音设计、语音克隆和语音定向三个功能。它在开源权重模型中排名第一（Artificial Analysis TTS 排行榜），甚至在某些方面超过了闭源商业系统。

简单来说：你给它文字，它就能生成自然、富有感情的人声。特别厉 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Mon, 31 Aug 2026 08:45:05 +0000</pubDate>
    </item>
    <item>
      <title>Audio8_TTS V2版：小而强，轻量多语言语音合成利器，小模型也能做出顶级多语言语音</title>
      <link>https://deepface.cc/thread-1121-1-1.html</link>
      <description><![CDATA[Audio8-TTS  是一个非常小巧的开源文本转语音（TTS）模型，主打“小而能用”的零样本声音克隆。它能把文字变成自然的语音，而且支持零样本声音克隆——只需提供一小段参考音频和对应文字，就能模仿那个人的声音说话，不需要额外训练。模型本身很小，比市面上很多多语言 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Tue, 25 Aug 2026 07:53:13 +0000</pubDate>
    </item>
    <item>
      <title>FireRedTTS3：从克隆到设计再到编辑，支持24语+21方言，让语音创作更自由</title>
      <link>https://deepface.cc/thread-1118-1-1.html</link>
      <description><![CDATA[FireRedTTS3 是小红书 FireRed 团队开源的新一代语音生成与编辑模型，基于“语义丰富的连续语音表示”，把语音合成和编辑统一到一个系统里。简单说，它就像一个“能克隆声音、能按描述造声音、还能像改文档一样改语音”的全能语音工具，特别适合需要高质量、多语言、可 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Sat, 22 Aug 2026 03:47:25 +0000</pubDate>
    </item>
    <item>
      <title>MiniMax-Music3 V2版：输入一句话，让 AI 从零创作一整首歌，不会写歌也能当音乐人</title>
      <link>https://deepface.cc/thread-1117-1-1.html</link>
      <description><![CDATA[MiniMax-Music3 是一个“输入歌词 + 告诉它想要什么风格，就能直接帮你做出一整首歌”的 AI 音乐生成模型。 它不只是生成一小段背景音乐，而是重点针对“完整歌曲”的生成，最长可以做到约 5 分钟，并且尽量保持歌曲前后风格、旋律、节奏和人声的一致性。




你只需要 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Fri, 21 Aug 2026 07:58:20 +0000</pubDate>
    </item>
    <item>
      <title>MiniMax-Music3：AI 音乐革命来了，输入一句话，让 AI 从零创作一整首歌，不会写歌也能当音乐人</title>
      <link>https://deepface.cc/thread-1112-1-1.html</link>
      <description><![CDATA[MiniMax-Music3 是一个“输入歌词 + 告诉它想要什么风格，就能直接帮你做出一整首歌”的 AI 音乐生成模型。 它不只是生成一小段背景音乐，而是重点针对“完整歌曲”的生成，最长可以做到约 5 分钟，并且尽量保持歌曲前后风格、旋律、节奏和人声的一致性。

你只需要提 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Fri, 14 Aug 2026 04:04:08 +0000</pubDate>
    </item>
    <item>
      <title>IndexTTS-2.5：一句话克隆任意声音，跨语言还能精准控情绪，让声音克隆更自由更自然</title>
      <link>https://deepface.cc/thread-1110-1-1.html</link>
      <description><![CDATA[IndexTTS-2.5 是由 Bilibili 的 IndexTeam 开发的一款开源零样本（zero-shot）文本转语音（TTS）模型。你只需要提供一小段参考音频（比如几秒钟的某人说话录音），模型就能“克隆”出这个人的声音，然后让它用这个声音朗读你输入的任意文字，还支持自定义情感控制，比 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 12 Aug 2026 02:52:35 +0000</pubDate>
    </item>
    <item>
      <title>Audio8_TTS：小而强，轻量多语言语音合成利器，小模型也能做出顶级多语言语音</title>
      <link>https://deepface.cc/thread-1100-1-1.html</link>
      <description><![CDATA[Audio8_TTS 是一个开源的多语言文本转语音（TTS）模型，参数量只有约 0.6B（6亿），却能达到接近业界顶级大模型的效果。它最大的亮点是零样本音色克隆：只需要一段参考音频和对应文字，就能让模型用这个人的声音说出新内容，不用重新训练。



主要特点

小而强：只有0 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Mon, 03 Aug 2026 03:32:21 +0000</pubDate>
    </item>
    <item>
      <title>VoxCPM V5版：新增字幕配音 从文字到灵魂之声，支持方言克隆与个性化声音创作 一键整合包下载</title>
      <link>https://deepface.cc/thread-1095-1-1.html</link>
      <description><![CDATA[VoxCPM（尤其是最新的VoxCPM2）是一个开源的AI语音合成工具（TTS），它无需传统的“离散音素切分”，直接生成自然、逼真的语音。它支持 30 种语言，能设计全新声音、克隆现有声音，并输出 48kHz 的录音室级音质，非常适合跨语言语音合成、创意声音设计和高保真语音克隆 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Tue, 28 Jul 2026 08:39:46 +0000</pubDate>
    </item>
    <item>
      <title>RVC V3版：AI变声器 用少量录音实现高质量AI变声与唱歌，适合翻唱配音与直播</title>
      <link>https://deepface.cc/thread-1093-1-1.html</link>
      <description><![CDATA[Retrieval-based-Voice-Conversion-WebUI（简称 RVC） 是一个开源的 AI 语音音色转换工具，简单说就是“变声器”框架。它能把一个人的说话/唱歌声音，转换成另一个人的音色，同时尽量保持原来的内容和语调。官方标语是“Easily train a good VC model with voice data  ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Sun, 26 Jul 2026 06:34:42 +0000</pubDate>
    </item>
    <item>
      <title>UniSE：多任务语音增强，一键搞定去噪、分离与提取 让嘈杂音频瞬间变清晰</title>
      <link>https://deepface.cc/thread-1081-1-1.html</link>
      <description><![CDATA[QuarkAudio-UniSE（简称 UniSE）是阿里巴巴 QuarkAudio 项目下的一个开源语音处理模型，简单说，它就是一个“多面手”语音清理和增强工具，用一个模型就能干好几件事，不需要切换不同工具或输入特殊指令。



主要功能

SR（Speech Restoration）：通用语音修复——去 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Thu, 16 Jul 2026 09:56:39 +0000</pubDate>
    </item>
    <item>
      <title>VoxCPM V4版：从文字到灵魂之声，支持方言克隆与个性化声音创作 一键整合包下载</title>
      <link>https://deepface.cc/thread-1076-1-1.html</link>
      <description><![CDATA[VoxCPM（尤其是最新的VoxCPM2）是一个开源的AI语音合成工具（TTS），它无需传统的“离散音素切分”，直接生成自然、逼真的语音。它支持 30 种语言，能设计全新声音、克隆现有声音，并输出 48kHz 的录音室级音质，非常适合跨语言语音合成、创意声音设计和高保真语音克隆 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Fri, 10 Jul 2026 10:21:42 +0000</pubDate>
    </item>
    <item>
      <title>ViiTorVoice-NAR：一句话克隆你的声音，支持局部修改和情感控制 一键整合包下载</title>
      <link>https://deepface.cc/thread-1071-1-1.html</link>
      <description><![CDATA[ViiTorVoice-NAR 是一个开源的语音生成工具（非自回归模型），主要用来实现语音克隆和语音局部编辑，能根据你的声音和文字快速生成自然富有情感的说话音频。
ViiTorVoice-NAR 是一个实用、灵活、速度快的本地语音AI工具，尤其适合需要精准控制和高效修改语音的场景。

 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Sat, 04 Jul 2026 02:46:22 +0000</pubDate>
    </item>
    <item>
      <title>AudioX-Turbo：四步极速生成音频神器：文字/视频一键转音效音乐 一键整合包下载</title>
      <link>https://deepface.cc/thread-1068-1-1.html</link>
      <description><![CDATA[AudioX-Turbo 是一个开源的 AI 音频生成工具，由 NoizAI（联合香港科技大学等机构）开发。它能根据文字、视频、音频等各种输入，快速生成对应的声音或音乐。简单说，就是一个“多模态转音频”的超级加速器。
AudioX-Turbo 解决了 AI 音频生成里“又慢又贵”的老大难问 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 01 Jul 2026 04:07:08 +0000</pubDate>
    </item>
    <item>
      <title>Confucius4-TTS：几秒克隆声音，跨语言情感迁移超自然，多语言自然配音神器 一键整合包下载</title>
      <link>https://deepface.cc/thread-1057-1-1.html</link>
      <description><![CDATA[Confucius4-TTS 是网易有道开源的一个多语言、跨语言零样本语音合成（TTS）引擎，简单来说，就是一个“一个声音，说遍多国语言”的AI语音工具。
Confucius4-TTS 特别适合需要“声音一致性 + 多语言支持”的场景，降低了传统TTS需要大量数据和训练的门槛，是目前开源领 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Mon, 22 Jun 2026 02:16:22 +0000</pubDate>
    </item>
    <item>
      <title>Higgs Audio v3 - 超自然多语言情感TTS，一键克隆声音 一键整合包下载</title>
      <link>https://deepface.cc/thread-1047-1-1.html</link>
      <description><![CDATA[Higgs Audio v3 TTS  是Boson AI推出的一款文本转语音（TTS）AI模型，它不仅朗读，更能进行富有表现力的对话式语音输出。该系统能将模型回应转化为跨越100多种语言的生动对话语音，并支持零样本语音克隆，以及实时控制情感、风格、韵律、停顿和音效。特别适合做真人般 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Sat, 13 Jun 2026 07:11:22 +0000</pubDate>
    </item>
    <item>
      <title>Dots.tts - 超自然语音合成利器，轻松实现真人级中文/多语配音 一键整合包下载</title>
      <link>https://deepface.cc/thread-1044-1-1.html</link>
      <description><![CDATA[dots.tts 是一个开源的文本转语音（TTS）AI模型，由 rednote-hilab（小红书） 团队开发。简单说，它能把文字变成自然、清晰的人声，而且效果很强。

dots.tts 是目前开源里比较顶尖的“自然声音克隆机”，在多项评分下，dots.tts超越了前几代主流TTS模型，比如IndexTTS ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 10 Jun 2026 00:47:35 +0000</pubDate>
    </item>
    <item>
      <title>PilotTTS - 情感语音合成利器，支持方言与多情绪控制 一键整合包下载</title>
      <link>https://deepface.cc/thread-1038-1-1.html</link>
      <description><![CDATA[PilotTTS 是高德（你没看错，就是高德地图）开源的一款基于大语言模型（LLM）的开源语音合成系统（Text-to-Speech，TTS）。它就像一个“聪明语音演员”，能把文字变成自然、富有感情的人声。不同于很多复杂的商业TTS，PilotTTS故意采用简洁模块化设计，全部使用开源组 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 03 Jun 2026 00:57:47 +0000</pubDate>
    </item>
    <item>
      <title>MOSS-SoundEffect - AI音效师，文字一键变音效，输入文字就能生成高质量音效 一键整合包下载</title>
      <link>https://deepface.cc/thread-1037-1-1.html</link>
      <description><![CDATA[MOSS-SoundEffect-v2.0 是一款高质量的文本生成声音效果（Text-to-Sound Effect）AI模型，由 OpenMOSS 团队开源，你输入一段自然语言描述（比如中文或英文），它就能生成对应的真实感声音效果，比如：  “一只狗在公园里大声叫” “雨点打在窗户上，远处有雷声” “键 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Tue, 02 Jun 2026 09:55:21 +0000</pubDate>
    </item>
    <item>
      <title>ClearerVoice V4版 - AI语音清洁神器：一键让噪音消失，语音变得超清晰 一键整合包下载</title>
      <link>https://deepface.cc/thread-1031-1-1.html</link>
      <description><![CDATA[ClearVoice 是阿里达摩院开源的一个语音处理工具包，简单来说，它就是一个“AI语音清洁工 + 分离师 + 升级器”。它能帮你处理各种“脏乱差”的音频，让语音听得更清楚、更干净。
ClearVoice 就是让“听不清”变成“听得清”的AI神器，不管你是普通用户想清理一段录音， ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Mon, 25 May 2026 08:01:17 +0000</pubDate>
    </item>
    <item>
      <title>Stable Audio 3 - 文字变音乐 从音效到完整歌曲 一键生成高质量长音频 一键整合包下载</title>
      <link>https://deepface.cc/thread-1027-1-1.html</link>
      <description><![CDATA[Stable Audio 3 是 Stability AI 推出的新一代AI音频生成模型，能根据文字描述快速生成高质量音乐和音效。

Stable Audio 3 就像“音频版的 Stable Diffusion”，让你用文字就能“写”出音乐或声音。它基于全新 SAME 语义-声学自动编码器，能生成更长、更连贯的音频， ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Fri, 22 May 2026 03:30:23 +0000</pubDate>
    </item>
  </channel>
</rss>