和“只跑一个 Whisper 命令”的差别
很多本地方案停留在单模型脚本或临时环境。OpenASR 把运行时、模型分发、桌面产品与本地 API 放在同一套产品边界里。
你可以用桌面直接转文件、听写;也可以用 CLI 批处理;或在本机起服务,用 HTTP API 接入自己的工具。内核开源,桌面是独立产品。
签名模型目录
模型不是随便丢一个权重文件了事。OpenASR 使用签名目录分发经过校验的模型包,常规转写不会在缺模型时静默下载。
目录覆盖多个模型系列,并包含说话人分离、中文标点等能力包。具体可用列表、体积与许可证以模型页面的实时目录为准。
- 按语言与任务挑选,而不是绑死单一检查点
- 下载需确认,CLI --offline 缺模型即失败
- 支持声纹 ID 的模型会在市场中标出
桌面产品能力
Desktop 面向日常使用:本机文件转写、听写与实时字幕。主打声纹 ID,并可使用内置 MOSS 说话人分离处理多人会议与访谈。
桌面应用目前提供 macOS 与 Windows,没有原生 Linux 桌面。Linux 场景走 CLI 或服务器。
给开发者的接口
公开 Rust CLI 覆盖转写、拉取模型、离线开关与说话人相关子命令(如 --diarize、speaker enroll)。
本地 HTTP API 便于把识别嵌进自己的工作流或服务。服务端亦提供 /v1/speakers 等接口。这些能力属于开源内核,可审计、可自建。
选择时建议看什么
先看语言与任务是否匹配,再看本机内存与存储能否放下所选量化,然后确认是否需要时间戳、分离、标点等功能,最后核对模型许可证。
不要假设“越大越好”。目录会标注推荐量化;以你的机器与场景为准,并到模型页查看当前可用项。