实时转写 · 中日韩英与粤语

SenseVoice Small

快速识别中文、粤语、英语、日语和韩语的多语言模型。

中日韩英与粤语 · 5.6× · 448.4 MB

在 OpenASR 桌面应用中安装

会打开桌面应用,并自动为你下载这个模型。

还没有桌面应用? 下载 OpenASR 桌面应用

本机转写在这台电脑上处理
interview.m4a12:04

我们先对一下这周的发布节奏,

beta 版本可以安排在周五,

然后同步给 design 和 QA,

为什么适合你

SenseVoice Small 面向中文、粤语、英语、日语和韩语等常用语言,特点是响应快。它适合东亚多语言内容、短音频和需要快速得到结果的任务。

你可以用它做什么

  • 对中文与粤语尤其友好。
  • 适合中、英、日、韩混合场景。
  • 响应速度极快,短音频几乎瞬间出结果。

其他模型

开发者详情 CLI 命令、文件哈希和不同量化版本,适合自动化脚本与完整性校验。

按量化版本下载

拉取命令大小量化
sensevoice-small:fp16默认 448.4 MB fp16
打开 .oasr
sensevoice-small:q8 240.8 MB q8_0
打开 .oasr
sensevoice-small:q4 130 MB q4_k
打开 .oasr

模型详细信息

大小448.4 MB
速度5.6× 倍实时
语言Multilingual
系列sensevoice
来源FunAudioLLM
发布时间2024-07-04
峰值内存710 MB
量化方式fp16
版本号52fa74567f213c8280fbea6e2d919709b7a7209f
sha25697a59d7cd080731a1972fc87fd089b3cccfd20ca77ce5bc3e90d54a8d0802ea7

使用方式

以下是 CLI/本地服务端示例。桌面应用无需输入任何命令即可运行此模型——用上方的“安装”即可。

bash · 转写文件
$ openasr pull sensevoice-small:fp16
↓ sensevoice-small.oasr  448.4 MB  ✓ verified sha256
$ openasr transcribe meeting.wav --backend native --model-pack ~/.openasr/models/sensevoice-small/fp16/sensevoice-small-fp16.oasr
✓ local transcript · 0 bytes sent
bash · 启动本地服务
$ openasr serve --backend native --model-pack ~/.openasr/models/sensevoice-small/fp16/sensevoice-small-fp16.oasr --addr 127.0.0.1:8080
▶ http://127.0.0.1:8080 · model=sensevoice-small · 0 bytes will leave this host
python · client.py
from openai import OpenAI
client = OpenAI(base_url="http://127.0.0.1:8080/v1", api_key="local")
audio = open("meeting.wav", "rb")
text = client.audio.transcriptions.create(model="sensevoice-small", file=audio)