实时转写 · 多语言

Whisper Small

紧凑好用的多语言模型,本地转写的均衡之选。

多语言 · 6.7× · 288.9 MB

在 OpenASR 桌面应用中安装

会打开桌面应用,并自动为你下载这个模型。

还没有桌面应用? 下载 OpenASR 桌面应用

本机转写在这台电脑上处理
interview.m4a12:04

我们先对一下这周的发布节奏,

beta 版本可以安排在周五,

然后同步给 design 和 QA,

为什么适合你

Whisper Small 是多语言转写中性价比很高的选择。体积不大,但比最小的模型准不少,日常用来转写会议、视频、课程录音都很合适。

你可以用它做什么

  • 支持多种语言,体积和准确度很均衡。
  • 适合日常会议、视频和课程转写。
  • 比最小的版本准确度明显更高。

其他模型

开发者详情 CLI 命令、文件哈希和不同量化版本,适合自动化脚本与完整性校验。

按量化版本下载

拉取命令大小量化
whisper-small:fp16 466.1 MB fp16
打开 .oasr
whisper-small:q8默认 288.9 MB q8_0
打开 .oasr
whisper-small:q4 194.4 MB q4_k
打开 .oasr

模型详细信息

大小288.9 MB
速度6.7× 倍实时
语言Multilingual
系列whisper
来源openai
发布时间2022-09-21
峰值内存959.2 MB
量化方式q8_0
许可证Apache-2.0
版本号b4a94dbeb838b14e93601d3622a416944bb3d921
sha2569116ff1cb3a2a48850ba4f557901b75f9ab9f4c6c252534d77bd9ed23e7bc008

使用方式

以下是 CLI/本地服务端示例。桌面应用无需输入任何命令即可运行此模型——用上方的“安装”即可。

bash · 转写文件
$ openasr pull whisper-small:q8
↓ whisper-small.oasr  288.9 MB  ✓ verified sha256
$ openasr transcribe meeting.wav --backend native --model-pack ~/.openasr/models/whisper-small/q8_0/whisper-small-q8_0.oasr
✓ local transcript · 0 bytes sent
bash · 启动本地服务
$ openasr serve --backend native --model-pack ~/.openasr/models/whisper-small/q8_0/whisper-small-q8_0.oasr --addr 127.0.0.1:8080
▶ http://127.0.0.1:8080 · model=whisper-small · 0 bytes will leave this host
python · client.py
from openai import OpenAI
client = OpenAI(base_url="http://127.0.0.1:8080/v1", api_key="local")
audio = open("meeting.wav", "rb")
text = client.audio.transcriptions.create(model="whisper-small", file=audio)