工作原理
OpenASR 在用户控制的硬件上处理语音。桌面应用、CLI 和本地 HTTP 服务器均使用签名验证目录中的 .oasr 模型包进行本地推理。
常规转写不会将音频发送到任何云服务。网络活动仅限于用户主动发起的模型下载、桌面更新清单检查,以及可选的远程计算功能——该功能仅将音频发送到用户通过 TLS 和首次信任证书锁定明确配对的另一台 OpenASR 服务器。
开源内核与桌面应用
开源内核——包括 Rust CLI、服务器和配套库——以 Apache-2.0 许可证发布,可在 macOS、Windows 和 Linux 上通过预编译发行版或源码编译运行。
macOS 和 Windows 桌面应用是基于开源内核构建的独立闭源产品。目前未发布原生 Linux 桌面应用。
模型目录
OpenASR 提供经过签名的模型目录,涵盖 Whisper、Qwen3-ASR、Parakeet-TDT、FireRed-AED、SenseVoice、Moonshine、Cohere Transcribe、X-ASR、Dolphin 和 Hy-MT2 等模型系列,以及说话人分离和中文标点等能力包。
常规转写不会静默下载缺失的模型,用户会看到提示并自行确认每次下载。CLI 的 --offline 选项禁止网络访问,若模型缺失则直接报错。