跳转到内容

OpenASR 使用文档

OpenASR 是一套在本地完成语音转文字的工具。想省心使用,可以打开桌面应用;需要批处理、自动化或接入其他程序,也可以使用命令行和本地 HTTP 接口。它们共用同一套以 Apache-2.0 协议开源的核心代码: github.com/QuintinShaw/openasr

  • 默认使用 native 后端,在本机运行基于 ggml 的 .oasr 模型包。某一步失败时会直接报错,不会生成看似正常的虚假结果。
  • 正常使用命令行或 API 时,不会在你不知情的情况下下载运行组件或模型。
  • 需要模型时,由你通过 openasr pull 发起下载;模型来自签名的 model-registry/catalog.json 目录,并会在安装前校验。
  • OpenASR 不包含遥测,也不会主动把使用数据传回服务器。

代码中另有一个隐藏的 mock 后端,只用于持续集成和内部流程测试,需要主动开启,也不会出现在公开的命令行帮助中。

  • 查看命令行完整说明,了解所有命令和常用示例。
  • 查看实时听写与字幕,了解麦克风/系统音频的实时转写用法。
  • 查看说话人分离,了解如何按说话人打标签和注册声纹。
  • 查看配置参考,了解配置文件、环境变量与 OPENASR_HOME 目录结构。
  • 查看本地接口,把 OpenASR 接入支持 OpenAI 转写接口的应用,并查看完整接口表。
  • 前往模型目录,根据语言和使用场景选择模型。
  • 查看当前支持情况,确认平台、安装方式和功能边界。