← 返回博客

产品发布

OpenASR 0.1.0:第一个公开版本

OpenASR 首个公开发布:一款基于 Apache-2.0 开放内核的 macOS 本地语音转文字应用。
OpenASR 0.1.0:第一个公开版本

OpenASR 0.1.0 正式发布——本地语音转文字,音频不离开你的电脑。这篇文章聊聊它现在能做什么,还缺什么,以及代码在哪里。

OpenASR 0.1.0 是第一个公开版本。它做的事情很简单:语音转文字,完全在本地完成。音频在你自己的机器上转录,不需要注册账号,没有云端转录链路,也没有遥测。这次发布分两部分——一个 Apache-2.0 开源内核负责所有核心工作,一个 macOS 桌面应用把它包装成可以直接安装使用的产品。

这是一个安静的首次发布,所以诚实地讲清楚现状比包装卖点更重要。下面说说它是什么,今天实际能用到什么程度,以及还有哪些没做。

它是什么

开源内核涵盖了整条语音处理流水线:音频采集、本地服务、模型校验、fail-closed 的模型拉取链路,以及沙箱和路径检查。代码在 Apache-2.0 仓库 里,你完全可以不装桌面应用,直接用命令行跑完整个转录流程。

macOS 桌面应用是套在这个内核外面的闭源外壳——负责引导流程、界面、打包、代码签名和自动更新。它没有引入任何隐藏的转录路径;所有接触你音频的代码,都是你能读到的那份开源代码。

现在能做什么

  • 文件转录,输出达到字幕级质量——拖入一个音频文件,拿到转录文本,支持导出 srt/vtt 字幕格式。
  • 听写,包括基于帧同步流式模型的实时文本插入,可以直接把识别结果输入到其他应用中。
  • 实时字幕——边说边转录,全程在设备上完成。
  • 从 Hugging Face 拉取本地模型,以 .oasr 包的形式分发,安装前会对照签名目录进行校验。
  • 默认纯本地运行——没有遥测,没有静默下载,除非你主动要求,否则没有任何数据离开你的电脑。

应用运行在搭载 Apple Silicon 的 macOS 上,已签名并完成公证,支持自动更新。

还缺什么

  • Windows 和 Linux 桌面应用。 都在计划中,但都还没有时间表。开源的 CLI 目前已经可以在 Linux 上运行。
  • 更多模型家族。 当前的模型目录刻意保持精简——更多语言、更多尺寸、不同的精度/速度权衡,会随着时间以签名包的形式逐步上线。

如果这两项中有你关心的,欢迎到 GitHub Issues 提出来。

代码在哪里

内核代码在 GitHub 上:QuintinShaw/openasr,Apache-2.0 协议,预编译的 CLI 二进制文件在 Releases 页面。去读代码,去 fork,或者自己跑一遍流水线——开放内核的意义就在于,你不需要对上面说的任何一句话「信以为真」。

Mac 应用是一个一键下载。这就是 0.1.0。

查看完整技术细节

中文版以中文读者更容易理解的方式整理了核心结论。代码、测试条件和完整数据请参考英文原文。

阅读英文原文 →
标签版本发布本地优先