anweat/dsh-voice-webspeech
anweat★ 0JavaScript最后同步: 2026-08-14
—
README 摘要
dsh-voice-webspeech DSH Web GUI 的 纯浏览器语音输入 插件:零服务端、零 API Key、零模型下载、零 Python。 按住输入框旁的麦克风按钮说话,松手即把语音转成文字——转写完全由 浏览器内置语音识别 (Web Speech API)完成: 浏览器 实际语音服务 Microsoft Edge 微软 Azure 语音 Google Chrome Google/Chrome 语音 与社区里 dsh-voice-funasr 的差异:后者以 本地 FunASR 引擎 为主(需安装 Python + 下载 520MB 模型),浏览器识别只是回退路径。本插件只做"浏览器内置识别"这一件事, 安装即用,适合不想要本地引擎开销的用户。 特性 - 按住说话 / 松手转文字 :按住麦克风按钮开始聆听,松手停止;期间连续短句自动累积。 - 实时反馈 :聆听时按钮上方悬浮显示"正在聆听… + 实时识别文字"(可关闭)。 - 两种落字方式 (设置里切换): - 默认"转进输入框":识别结果写入 composer,可编辑后再发送;支持 追加 到已有文字。 - "松手自动发送":识别完成直接发送(免提)。 - 多语言 :中文普通话/粤语/繁体、英/日/韩/法/德/西/俄等(BCP-47)。 - 隐私 :音频直接交给浏览器语音服务,不经过任何 DSH 服务端、不落盘。 兼容性 - DSH: =0.1.0-rc.3 =24.0.0 - 浏览器:需 Edge 或 Chrome(Web Speech API);Firefox/Safari 不支持 - 麦克风:浏览器需获得麦克风权限(首次使用会在地址栏请求授权) 安装 插件为 out-of-tree client bundle( dsh.client + dsh.bundle.patch )。 仓库已提交构建产物 lib/ ,git 安装无需再 build。 方式 A:从 GitHub 安装(推荐) 若 pnpm ≥10 提示需要 allowBuilds(因 prepare ),把打印的包键写进 profile 的 pnpm-workspace.yaml 后重跑;本仓库已提交 lib/ ,通常不会触发。建议固定到提交: github:anweat/dsh-voice-webspeech 。 方式 B:本地 checkout 开发链接 方式 C:打包 tgz 安装 激活 :重启 dsh web ( pnpm dsh web )。插件的 dsh.bundle.patch 会把它自动挂进 插件树,客户端 bundle 由 dsh.client 声明 + exports["./client"] 自动加载。 不要手工把本插件插进 profile 的 cordis.patch.yml ,否则同一 loader id 会…
在 GitHub 查看完整 README →