设为首页收藏本站 劰载中...

 找回密码
 立即注册
查看: 97|回复: 0

Audio8_TTS V2版:小而强,轻量多语言语音合成利器,小模型也能做出顶级多语言语音

[复制链接]

1079

主题

1950

回帖

14万

积分

武林盟主

积分
143795

宣传达人灌水之王突出贡献荣誉管理论坛元老

QQ
发表于 昨天 15:53 | 显示全部楼层 |阅读模式

马上注册,下载更多AI资源软件

您需要 登录 才可以下载或查看,没有账号?立即注册

×

Audio8_TTS V2版:小而强,轻量多语言语音合成利器,小模型也能做出顶级多语言语音 ... ... ... ...

Audio8_TTS V2版:小而强,轻量多语言语音合成利器,小模型也能做出顶级多语言语音 ... ... ... ...

Audio8-TTS  是一个非常小巧的开源文本转语音(TTS)模型,主打“小而能用”的零样本声音克隆。它能把文字变成自然的语音,而且支持零样本声音克隆——只需提供一小段参考音频和对应文字,就能模仿那个人的声音说话,不需要额外训练。模型本身很小,比市面上很多多语言TTS模型小得多,但在中文和英语上表现已经比较可用。

今天分享的 Audio8_TTS V2版,和上个版本相比,V2版打包更轻更小更快的0.1B模型,支持无显卡设备使用CPU流畅运行,同时支持CUDA独显运行。该版为适配低配设备打包制作,适合无独立显卡设备运行。



主要特点

极致轻量:主生成模型约170M参数,整体远小于常见的0.6B–几B规模的TTS模型,更适合资源有限的场景。
零样本声音克隆:给一段参考音频就能克隆音色,无需微调。
多语言支持:
主要语言:中文、英语(效果最好)
实验性支持:德语、西班牙语、法语、意大利语、日语、韩语

高采样率音频:使用44.1 kHz神经音频编解码器,声音质量较清晰。



应用领域

个性化语音助手、虚拟角色配音
短视频/播客/有声内容的快速配音
多语言内容生成(尤其是中英)
教育、辅助工具(如把文字转成语音朗读)
原型开发和资源受限环境(手机、嵌入式设备、本地服务器)




使用教程:(支持无独显CPU运行,支持50系显卡)

输入需要合成的文字内容,上传参考音频,输入参考文本,生成即可。

注.因模型限制,建议生成不超过1分钟的音频,建议30秒左右。如需要生成超长文本,可分段处理。
支持CPU运行,下方“生成设置”展开切换到CPU




下载地址:
迅雷云盘:https://pan.xunlei.com/s/VP-s3khuE6yV48UEVz4B8vxKA1?pwd=smbg

夸克网盘:
🔒付费内容
游客, 上上宾会员 可免费下载该资源,点此开通上上宾 免费下载全站99%的付费资源。或单独支付 20碎银 下载该资源


百度网盘:
🔒付费内容
游客, 上上宾会员 可免费下载该资源,点此开通上上宾 免费下载全站99%的付费资源。或单独支付 40碎银 下载该资源

DEEPFACE论坛免责声明
本论坛发布的所有内容,包括图片、软件、模型等部分来自网络,版权归原作者所有。
本论坛提供的内容仅用于个人学习和研究,请勿滥用,否则由此引发的责任需自行承担。
请合理合法使用AI技术,并遵守当地法律法规,不要用于违法用途!
如本站发布内容侵犯了你的合法权益,请联系我们删除。
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)

各种参数DFL换脸模型/实时换脸模型底丹、实时换脸模型训练教学/实时换脸模型定制、AI软件个性化及功能定制
论坛所有一键包报错请在帖子下方跟帖,看到会回复,不支持一对一解答,请确认再下载!
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|前沿AI软件资源与资讯

GMT+8, 2026-8-26 13:14 , Processed in 0.030553 second(s), 5 queries , Redis On.

Powered by Discuz! X3.5

©2001-2023 Discuz! Team

快速回复 返回顶部 返回列表