马上注册,下载更多AI资源软件
您需要 登录 才可以下载或查看,没有账号?立即注册
×
Audio8-ASR:小身材大能力,超轻量多语言语音识别模型 一键语音转SRT字幕
Audio8-ASR-0.1B 是一个非常小巧、轻量的自动语音识别(ASR)模型,专门用来把说话内容转成文字。它就是一个“小而美”的语音转文字模型,特别适合想在资源受限环境下跑本地、多语言语音识别的场景。
今天分享的 Audio8-ASR 基于Audio8-ASR-0.1B超轻量模型打包制作,支持无显卡设备一键快速转写,并将结果转写成txt和srt字幕文件,同时支持一键批量转写,离线不联网,无隐私安全隐患,并且支持中文、英文、法语、德语、日语、韩语、粤语等 7 种语言。
主要特点
超小体积:语言模型部分只有约 0.1B(1亿)参数,整体模型大约 0.3B 参数,是目前大模型时代里“能用且性能不错”的超小型 ASR 之一。
多语言支持:能识别中文、英文、法语、德语、日语、韩语、粤语等 7 种语言。
性能不错:在英文公开测试集上平均词错误率(WER)约 7.03%,中文测试也表现良好(字符错误率大概 8% 左右)。
支持热词(Hotword):不需要重新训练,就能在识别时临时加强某些关键词的识别准确率(比如人名、品牌、专业术语)。
应用领域
手机/边缘设备本地语音转文字(隐私好、不依赖网络)
会议/访谈录音转写
语音助手、字幕生成
多语言语音内容处理(尤其适合需要同时支持中英日韩等语言的场景)
对计算资源有限的设备(比如嵌入式设备、低端手机)做实时或近实时语音识别
使用教程:(支持CPU和CUDA两种运行模式,无限卡也能流畅运行)
上传需要转写的音频,支持单次和批量两种模式,生成的结果可以一键导出下载txt文档和srt字幕文件。
支持自定义热词功能(比如人名、品牌、专业术语)
默认生成结果保存在 outputs 目录
下载地址:
迅雷云盘:https://pan.xunlei.com/s/VP0pw55smukeBfEeCCnauWDFA1?pwd=z5he
夸克网盘:
🔒付费内容 游客, 上上宾会员 可免费下载该资源, 点此开通上上宾 免费下载全站99%的付费资源。或单独支付 20碎银 下载该资源
百度网盘:
🔒付费内容 游客, 上上宾会员 可免费下载该资源, 点此开通上上宾 免费下载全站99%的付费资源。或单独支付 40碎银 下载该资源
|