<?xml version="1.0" encoding="utf-8"?>
<rss version="2.0">
  <channel>
    <title>前沿AI软件资源站 - AI语音</title>
    <link>https://deepface.cc/forum-20-1.html</link>
    <description>Latest 20 threads of AI语音</description>
    <copyright>Copyright(C) 前沿AI软件资源站</copyright>
    <generator>Discuz! Board by Comsenz Inc.</generator>
    <lastBuildDate>Tue, 21 Jul 2026 04:17:56 +0000</lastBuildDate>
    <ttl>60</ttl>
    <image>
      <url>https://deepface.cc/static/image/common/logo_88_31.gif</url>
      <title>前沿AI软件资源站</title>
      <link>https://deepface.cc/</link>
    </image>
    <item>
      <title>UniSE：多任务语音增强，一键搞定去噪、分离与提取 让嘈杂音频瞬间变清晰</title>
      <link>https://deepface.cc/thread-1081-1-1.html</link>
      <description><![CDATA[QuarkAudio-UniSE（简称 UniSE）是阿里巴巴 QuarkAudio 项目下的一个开源语音处理模型，简单说，它就是一个“多面手”语音清理和增强工具，用一个模型就能干好几件事，不需要切换不同工具或输入特殊指令。



主要功能

SR（Speech Restoration）：通用语音修复——去 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Thu, 16 Jul 2026 09:56:39 +0000</pubDate>
    </item>
    <item>
      <title>VoxCPM V4版：从文字到灵魂之声，支持方言克隆与个性化声音创作 一键整合包下载</title>
      <link>https://deepface.cc/thread-1076-1-1.html</link>
      <description><![CDATA[VoxCPM（尤其是最新的VoxCPM2）是一个开源的AI语音合成工具（TTS），它无需传统的“离散音素切分”，直接生成自然、逼真的语音。它支持 30 种语言，能设计全新声音、克隆现有声音，并输出 48kHz 的录音室级音质，非常适合跨语言语音合成、创意声音设计和高保真语音克隆 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Fri, 10 Jul 2026 10:21:42 +0000</pubDate>
    </item>
    <item>
      <title>ViiTorVoice-NAR：一句话克隆你的声音，支持局部修改和情感控制 一键整合包下载</title>
      <link>https://deepface.cc/thread-1071-1-1.html</link>
      <description><![CDATA[ViiTorVoice-NAR 是一个开源的语音生成工具（非自回归模型），主要用来实现语音克隆和语音局部编辑，能根据你的声音和文字快速生成自然富有情感的说话音频。
ViiTorVoice-NAR 是一个实用、灵活、速度快的本地语音AI工具，尤其适合需要精准控制和高效修改语音的场景。

 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Sat, 04 Jul 2026 02:46:22 +0000</pubDate>
    </item>
    <item>
      <title>AudioX-Turbo：四步极速生成音频神器：文字/视频一键转音效音乐 一键整合包下载</title>
      <link>https://deepface.cc/thread-1068-1-1.html</link>
      <description><![CDATA[AudioX-Turbo 是一个开源的 AI 音频生成工具，由 NoizAI（联合香港科技大学等机构）开发。它能根据文字、视频、音频等各种输入，快速生成对应的声音或音乐。简单说，就是一个“多模态转音频”的超级加速器。
AudioX-Turbo 解决了 AI 音频生成里“又慢又贵”的老大难问 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 01 Jul 2026 04:07:08 +0000</pubDate>
    </item>
    <item>
      <title>Confucius4-TTS：几秒克隆声音，跨语言情感迁移超自然，多语言自然配音神器 一键整合包下载</title>
      <link>https://deepface.cc/thread-1057-1-1.html</link>
      <description><![CDATA[Confucius4-TTS 是网易有道开源的一个多语言、跨语言零样本语音合成（TTS）引擎，简单来说，就是一个“一个声音，说遍多国语言”的AI语音工具。
Confucius4-TTS 特别适合需要“声音一致性 + 多语言支持”的场景，降低了传统TTS需要大量数据和训练的门槛，是目前开源领 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Mon, 22 Jun 2026 02:16:22 +0000</pubDate>
    </item>
    <item>
      <title>Higgs Audio v3 - 超自然多语言情感TTS，一键克隆声音 一键整合包下载</title>
      <link>https://deepface.cc/thread-1047-1-1.html</link>
      <description><![CDATA[Higgs Audio v3 TTS  是Boson AI推出的一款文本转语音（TTS）AI模型，它不仅朗读，更能进行富有表现力的对话式语音输出。该系统能将模型回应转化为跨越100多种语言的生动对话语音，并支持零样本语音克隆，以及实时控制情感、风格、韵律、停顿和音效。特别适合做真人般 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Sat, 13 Jun 2026 07:11:22 +0000</pubDate>
    </item>
    <item>
      <title>Dots.tts - 超自然语音合成利器，轻松实现真人级中文/多语配音 一键整合包下载</title>
      <link>https://deepface.cc/thread-1044-1-1.html</link>
      <description><![CDATA[dots.tts 是一个开源的文本转语音（TTS）AI模型，由 rednote-hilab（小红书） 团队开发。简单说，它能把文字变成自然、清晰的人声，而且效果很强。

dots.tts 是目前开源里比较顶尖的“自然声音克隆机”，在多项评分下，dots.tts超越了前几代主流TTS模型，比如IndexTTS ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 10 Jun 2026 00:47:35 +0000</pubDate>
    </item>
    <item>
      <title>PilotTTS - 情感语音合成利器，支持方言与多情绪控制 一键整合包下载</title>
      <link>https://deepface.cc/thread-1038-1-1.html</link>
      <description><![CDATA[PilotTTS 是高德（你没看错，就是高德地图）开源的一款基于大语言模型（LLM）的开源语音合成系统（Text-to-Speech，TTS）。它就像一个“聪明语音演员”，能把文字变成自然、富有感情的人声。不同于很多复杂的商业TTS，PilotTTS故意采用简洁模块化设计，全部使用开源组 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 03 Jun 2026 00:57:47 +0000</pubDate>
    </item>
    <item>
      <title>MOSS-SoundEffect - AI音效师，文字一键变音效，输入文字就能生成高质量音效 一键整合包下载</title>
      <link>https://deepface.cc/thread-1037-1-1.html</link>
      <description><![CDATA[MOSS-SoundEffect-v2.0 是一款高质量的文本生成声音效果（Text-to-Sound Effect）AI模型，由 OpenMOSS 团队开源，你输入一段自然语言描述（比如中文或英文），它就能生成对应的真实感声音效果，比如：  “一只狗在公园里大声叫” “雨点打在窗户上，远处有雷声” “键 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Tue, 02 Jun 2026 09:55:21 +0000</pubDate>
    </item>
    <item>
      <title>ClearerVoice V4版 - AI语音清洁神器：一键让噪音消失，语音变得超清晰 一键整合包下载</title>
      <link>https://deepface.cc/thread-1031-1-1.html</link>
      <description><![CDATA[ClearVoice 是阿里达摩院开源的一个语音处理工具包，简单来说，它就是一个“AI语音清洁工 + 分离师 + 升级器”。它能帮你处理各种“脏乱差”的音频，让语音听得更清楚、更干净。
ClearVoice 就是让“听不清”变成“听得清”的AI神器，不管你是普通用户想清理一段录音， ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Mon, 25 May 2026 08:01:17 +0000</pubDate>
    </item>
    <item>
      <title>Stable Audio 3 - 文字变音乐 从音效到完整歌曲 一键生成高质量长音频 一键整合包下载</title>
      <link>https://deepface.cc/thread-1027-1-1.html</link>
      <description><![CDATA[Stable Audio 3 是 Stability AI 推出的新一代AI音频生成模型，能根据文字描述快速生成高质量音乐和音效。

Stable Audio 3 就像“音频版的 Stable Diffusion”，让你用文字就能“写”出音乐或声音。它基于全新 SAME 语义-声学自动编码器，能生成更长、更连贯的音频， ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Fri, 22 May 2026 03:30:23 +0000</pubDate>
    </item>
    <item>
      <title>RVC-Beatrice - 一键AI翻唱+配音+变声 基于RVC V2+Beatrice V2 的语音转换 一键整合包下载</title>
      <link>https://deepface.cc/thread-1017-1-1.html</link>
      <description><![CDATA[RVC-Beatrice 是一个用于语音转换的AI工具，不仅能直接变声，还能自己一键训练任意声音模型，它就像一个“AI 声音化妆师”，能把一段声音快速变成另一种声音（比如把男声变女声、把自己变成动漫角色、歌手或名人声音）。

今天分享的 RVC-Beatrice 是一个简单易用的语 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Sun, 10 May 2026 08:42:00 +0000</pubDate>
    </item>
    <item>
      <title>MOSS-TTS-Nano V2版 - 轻量级多语言实时语音生成模型，CPU+CUDA双模式实时运行 一键整合包下载</title>
      <link>https://deepface.cc/thread-1011-1-1.html</link>
      <description><![CDATA[MOSS-TTS-Nano 是一个轻量级的开源多语言语音生成模型，特点是体积小（仅 0.1B 参数）、可在普通 CPU 上实时运行，无需 GPU，特别适合想在普通设备上快速落地语音功能（即时语音交互）的开发者或个人用户。它支持中文、英文等 20 种语言，能进行语音克隆和长文本朗读， ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Sun, 03 May 2026 14:50:52 +0000</pubDate>
    </item>
    <item>
      <title>MOSS-TTSD V6版 - 超自然多人对话语音生成 AI播客制作软件 支持多人语音克隆 一键整合包下载</title>
      <link>https://deepface.cc/thread-1008-1-1.html</link>
      <description><![CDATA[MOSS-TTSD 是一个开源的 AI 对话语音生成模型，专门用来把文字对话脚本直接变成听起来非常自然、像真人聊天的语音。
通俗的讲，只需要上传两段参考音频，输入两个人的对话文字内容，即可一键生成两人的对话音频内容，生成对话语音自然、且富有表现力，几乎接近真人对话 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 29 Apr 2026 13:51:17 +0000</pubDate>
    </item>
    <item>
      <title>Fun-CineForge - 用AI一键给电影电视剧自动配音，零样本超自然效果 一键整合包下载</title>
      <link>https://deepface.cc/thread-1005-1-1.html</link>
      <description><![CDATA[FunCineForge 是一个开源的 AI 电影、电视剧配音项目，专门用来解决电影和电视剧自动配音的问题。它能让 AI 在各种复杂的影视场景里，实现“零样本”的高质量配音。能处理不同类型的影视场景（独白、旁白、对话、多角色场景），在音质、口型同步和声音风格切换方面效果 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Fri, 17 Apr 2026 05:23:29 +0000</pubDate>
    </item>
    <item>
      <title>Woosh - 文字、视频一键生成逼真音效 AI音效生成/视频配音 一键整合包下载</title>
      <link>https://deepface.cc/thread-1004-1-1.html</link>
      <description><![CDATA[Woosh 是 Sony AI 开发的一套「音效生成模型」，它能根据文字或视频自动生成音效，帮助创作者快速获得高质量的声音素材。简单说，就是用 AI 根据文字描述或视频画面自动生成真实、自然的音效。
Woosh 就像配音师一样，可以“看文字画声音”或“看视频配声音”。比如， ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Thu, 16 Apr 2026 14:21:38 +0000</pubDate>
    </item>
    <item>
      <title>MOSS-TTS-Nano - 轻量级多语言实时语音生成模型，CPU 即可实时运行 一键整合包下载</title>
      <link>https://deepface.cc/thread-1002-1-1.html</link>
      <description><![CDATA[MOSS-TTS-Nano 是一个轻量级的开源多语言语音生成模型，特点是体积小（仅 0.1B 参数）、可在普通 CPU 上实时运行，无需 GPU，特别适合想在普通设备上快速落地语音功能（即时语音交互）的开发者或个人用户。它支持中文、英文等 20 种语言，能进行语音克隆和长文本朗读， ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Tue, 14 Apr 2026 11:04:02 +0000</pubDate>
    </item>
    <item>
      <title>MOSS-TTS - 全能语音生成神器 高保真度、高表现力和复杂现实场景设计 一键整合包下载</title>
      <link>https://deepface.cc/thread-1001-1-1.html</link>
      <description><![CDATA[MOSS-TTS 是一个开源的语音与声音生成模型家族，特点是高保真、强表现力，并且能应对复杂的真实场景，如长篇语音、多角色对话、实时语音合成和环境音效生成。它不仅能“读出来”，还能“设计声音”，适合从语音助手到影视游戏的多种应用。


主要特点

声音特别真实、 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Mon, 13 Apr 2026 09:16:17 +0000</pubDate>
    </item>
    <item>
      <title>VoxCPM V3版 - 更新VoxCPM2，真人级多语言声音克隆 自然语言设计声音 一键整合包下载</title>
      <link>https://deepface.cc/thread-996-1-1.html</link>
      <description><![CDATA[VoxCPM 是一个开源的文本转语音（TTS）系统，它的最大特点是“无分词器”设计，可以直接从文字生成连续的语音信号，实现更自然的语音合成和逼真的声音克隆。它支持多语言，能在实时场景下运行，并且只需一段短音频就能模仿说话者的声音。

简单说就是：你输入文字，它 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 08 Apr 2026 23:57:41 +0000</pubDate>
    </item>
    <item>
      <title>ACE-Step V5版 - 用AI创作音乐歌曲 10秒生成完整歌曲 一键整合包下载</title>
      <link>https://deepface.cc/thread-995-1-1.html</link>
      <description><![CDATA[ACE-Step 是一个超级强大的本地AI音乐生成模型，即使是不懂音乐的小白，也可以让你在自己电脑上直接创作完整歌曲，生成音乐质量能超过大部分商业付费音乐AI（如接近或超越Suno v4.5水平），而且完全免费开源。

它就像一个“本地版Suno/Udio”，你输入一段文字描述（比 ...]]></description>
      <category>AI语音</category>
      <author>无言以对</author>
      <pubDate>Wed, 08 Apr 2026 02:20:27 +0000</pubDate>
    </item>
  </channel>
</rss>