实时转写 · 25 种欧洲语言

Parakeet TDT 0.6B v3

速度出色的欧洲多语言模型,自带单词级时间戳。

25 种欧洲语言 · 7.8× · 876.6 MB

在 OpenASR 桌面应用中安装

会打开桌面应用,并自动为你下载这个模型。

还没有桌面应用? 下载 OpenASR 桌面应用

本机转写在这台电脑上处理
interview.m4a12:04

我们先对一下这周的发布节奏,

beta 版本可以安排在周五,

然后同步给 design 和 QA,

为什么适合你

Parakeet TDT 0.6B v3 是 NVIDIA 推出的多语言语音识别模型,覆盖 25 种欧洲语言,能自动判断所说语言。它尤其适合需要快速处理大量录音、同时希望获得单词级时间戳的场景。

你可以用它做什么

  • 一个模型覆盖 25 种欧洲语言,自动识别语种。
  • 转写速度快,适合批量文件和较长录音。
  • 自带单词级时间戳,转写结果自动保留标点和大小写。

其他模型

开发者详情 CLI 命令、文件哈希和不同量化版本,适合自动化脚本与完整性校验。

按量化版本下载

拉取命令大小量化
parakeet-tdt-0.6b-v3:fp16 1.3 GB fp16
打开 .oasr
parakeet-tdt-0.6b-v3:q8默认 876.6 MB q8_0
打开 .oasr
parakeet-tdt-0.6b-v3:q4 624.2 MB q4_k
打开 .oasr

模型详细信息

大小876.6 MB
速度7.8× 倍实时
语言Multilingual
系列parakeet-tdt
来源nvidia
发布时间2025-08-14
峰值内存1 GB
量化方式q8_0
许可证CC-BY-4.0
版本号4a16094df4ec3ab6081089a5aff415c2042342b7
sha2564416134e5f4d42690ecfe6b2be8c30fcb3186eb5491434195355a1597f497454

使用方式

以下是 CLI/本地服务端示例。桌面应用无需输入任何命令即可运行此模型——用上方的“安装”即可。

bash · 转写文件
$ openasr pull parakeet-tdt-0.6b-v3:q8
↓ parakeet-tdt-0.6b-v3.oasr  876.6 MB  ✓ verified sha256
$ openasr transcribe meeting.wav --backend native --model-pack ~/.openasr/models/parakeet-tdt-0.6b-v3/q8_0/parakeet-tdt-0.6b-v3-q8_0.oasr
✓ local transcript · 0 bytes sent
bash · 启动本地服务
$ openasr serve --backend native --model-pack ~/.openasr/models/parakeet-tdt-0.6b-v3/q8_0/parakeet-tdt-0.6b-v3-q8_0.oasr --addr 127.0.0.1:8080
▶ http://127.0.0.1:8080 · model=parakeet-tdt-0.6b-v3 · 0 bytes will leave this host
python · client.py
from openai import OpenAI
client = OpenAI(base_url="http://127.0.0.1:8080/v1", api_key="local")
audio = open("meeting.wav", "rb")
text = client.audio.transcriptions.create(model="parakeet-tdt-0.6b-v3", file=audio)