设为首页收藏本站 劰载中...

 找回密码
 立即注册
查看: 23|回复: 0

Audio8-ASR:小身材大能力,超轻量多语言语音识别模型 一键语音转SRT字幕

[复制链接]

1090

主题

1980

回帖

14万

积分

武林盟主

积分
146599

宣传达人灌水之王突出贡献荣誉管理论坛元老

QQ
发表于 1 小时前 | 显示全部楼层 |阅读模式

马上注册,下载更多AI资源软件

您需要 登录 才可以下载或查看,没有账号?立即注册

×

Audio8-ASR:小身材大能力,超轻量多语言语音识别模型 一键语音转SRT字幕

Audio8-ASR:小身材大能力,超轻量多语言语音识别模型 一键语音转SRT字幕

Audio8-ASR-0.1B 是一个非常小巧、轻量的自动语音识别(ASR)模型,专门用来把说话内容转成文字。它就是一个“小而美”的语音转文字模型,特别适合想在资源受限环境下跑本地、多语言语音识别的场景。

今天分享的 Audio8-ASR 基于Audio8-ASR-0.1B超轻量模型打包制作,支持无显卡设备一键快速转写,并将结果转写成txt和srt字幕文件,同时支持一键批量转写,离线不联网,无隐私安全隐患,并且支持中文、英文、法语、德语、日语、韩语、粤语等 7 种语言。



主要特点

超小体积:语言模型部分只有约 0.1B(1亿)参数,整体模型大约 0.3B 参数,是目前大模型时代里“能用且性能不错”的超小型 ASR 之一。
多语言支持:能识别中文、英文、法语、德语、日语、韩语、粤语等 7 种语言。
性能不错:在英文公开测试集上平均词错误率(WER)约 7.03%,中文测试也表现良好(字符错误率大概 8% 左右)。
支持热词(Hotword):不需要重新训练,就能在识别时临时加强某些关键词的识别准确率(比如人名、品牌、专业术语)。



应用领域

手机/边缘设备本地语音转文字(隐私好、不依赖网络)
会议/访谈录音转写
语音助手、字幕生成
多语言语音内容处理(尤其适合需要同时支持中英日韩等语言的场景)
对计算资源有限的设备(比如嵌入式设备、低端手机)做实时或近实时语音识别



使用教程:(支持CPU和CUDA两种运行模式,无限卡也能流畅运行)

上传需要转写的音频,支持单次和批量两种模式,生成的结果可以一键导出下载txt文档和srt字幕文件。
支持自定义热词功能(比如人名、品牌、专业术语)
默认生成结果保存在 outputs 目录




下载地址:
迅雷云盘:https://pan.xunlei.com/s/VP0pw55smukeBfEeCCnauWDFA1?pwd=z5he

夸克网盘:
🔒付费内容
游客, 上上宾会员 可免费下载该资源,点此开通上上宾 免费下载全站99%的付费资源。或单独支付 20碎银 下载该资源



百度网盘:
🔒付费内容
游客, 上上宾会员 可免费下载该资源,点此开通上上宾 免费下载全站99%的付费资源。或单独支付 40碎银 下载该资源


DEEPFACE论坛免责声明
本论坛发布的所有内容,包括图片、软件、模型等部分来自网络,版权归原作者所有。
本论坛提供的内容仅用于个人学习和研究,请勿滥用,否则由此引发的责任需自行承担。
请合理合法使用AI技术,并遵守当地法律法规,不要用于违法用途!
如本站发布内容侵犯了你的合法权益,请联系我们删除。
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)

各种参数DFL换脸模型/实时换脸模型底丹、实时换脸模型训练教学/实时换脸模型定制、AI软件个性化及功能定制
论坛所有一键包报错请在帖子下方跟帖,看到会回复,不支持一对一解答,请确认再下载!
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|前沿AI软件资源与资讯

GMT+8, 2026-9-6 17:57 , Processed in 0.035274 second(s), 5 queries , Redis On.

Powered by Discuz! X3.5

©2001-2023 Discuz! Team

快速回复 返回顶部 返回列表