← 返回博客

产品发布

OpenASR Desktop 正式支持 Windows

OpenASR Desktop 今天登陆 Windows——本地优先的语音转文字工具,现已覆盖 macOS 和 Windows。
OpenASR Desktop 正式支持 Windows

同一套本地优先的语音识别能力,现在可以在 Windows 上使用了。同样的开源内核,同样的隐私边界,同样的 26 个模型。首次启动会遇到 SmartScreen 提示,这里一并说清楚。


从今天起,OpenASR Desktop 可以在 Windows 上运行了。如果你之前在 macOS 上用过,所有经验都可以直接迁移——模型、本地 HTTP API、隐私边界,完全一致。如果你是第一次接触 OpenASR,下面是你需要知道的事情。

功能概览

Windows 版提供与 macOS 版完全相同的功能集:

  • 文件转写——导入音频文件,输出转写文本,支持 SRT/VTT 字幕导出。
  • 听写输入——实时将语音插入到其他应用中。
  • 实时字幕——边说边转写,全程在本地完成。
  • 说话人分离——匿名的”谁说了什么”标签,仅在当前会话内有效,嵌入向量在会话结束后丢弃。
  • 系统音频捕获——转写电脑正在播放的音频,包括会议录音。
  • 热词——让识别引擎优先识别你指定的人名和术语。

通过签名目录可以获取 26 个模型。所有推理都在本地运行,没有任何音频会离开你的设备。

系统要求

  • Windows 10 或更高版本,x64 架构。
  • 应用通过 Azure Trusted Signing 进行代码签名(发布者:Caelum Inc.)。

底层的 Rust 开源内核与 macOS、Linux 上运行的是同一套 Apache-2.0 代码库。桌面外壳是闭源的,但不包含任何隐藏的转写路径——所有接触音频的代码都是开源的,可以在 github.com/QuintinShaw/openasr 查看。

关于 SmartScreen 提示

首次启动 OpenASR 时,Windows SmartScreen 可能会弹出一个”无法识别的应用”警告。这是正常现象——SmartScreen 依据下载量来建立发布者信誉,一个刚上线的应用自然还没有积累。

处理方法很简单:

  1. 在 SmartScreen 对话框中点击更多信息
  2. 点击仍要运行

就这样。应用本身携带受信任证书颁发机构签发的有效证书,SmartScreen 质疑的不是签名的合法性,而是发布者的”新”。随着下载量增长,这个警告会自动消失。

我们宁可提前把这件事说清楚,也不想让你在第一次启动时心里犯嘀咕。没有任何问题。

下载与中国大陆加速

官方下载页面获取 Windows 安装包。中国大陆用户会自动路由到加速通道,无需额外配置。

接下来

安装,打开,选一个模型,开始说话。如果遇到问题或者觉得哪里不对,请在 GitHub 上提 issue——我们在那里跟踪所有问题,也是最快得到回复的方式。

如果你觉得 OpenASR 有用,在 GitHub 上点个 star 比你想象中更有帮助。这是其他人发现这个项目的主要途径。

查看完整技术细节

中文版以中文读者更容易理解的方式整理了核心结论。代码、测试条件和完整数据请参考英文原文。

阅读英文原文 →
标签版本发布Windows本地优先