franksong2702/dsh-voice-input

franksong2702★ 0TypeScriptLast synced: 2026-08-16

Open on GitHub

Manual browser speech-to-text input for DeepSeek Harness Web

README excerpt

dsh-voice-input DeepSeek Harness Web 的手动语音输入插件。 - 单击麦克风开始录音,再次单击后结束识别并把文字写入原生输入框。 - 默认不会自动发送;可以在插件配置中明确开启。插件不会朗读模型回复,也不会启动实时语音对话。 - 使用 Chrome 或 Edge 的 Web Speech API;音频会交给浏览器的语音服务,不经过 DSH 服务端。 - 在“设置 → 插件 → 插件配置”的“语音输入”卡片中选择识别语言;设置保存在当前浏览器中。 - 麦克风位于 Composer 工具栏;听写过程中,Composer 上方会同时显示不会再变化的最终文字和仍可能修正的临时文字。临时文字不会写入正式草稿。 - 停止听写后,插件只把最终文字写入 Composer 一次,再按模型润色和自动发送设置继续处理。 - 转写完成提示会在 3 秒后自动消失。 - “启用模型润色”默认关闭。开启后,从当前 DSH 可用模型列表中选择一个模型;每次转写完成后,插件会把原始转写和当前 Session 最近 6 条可见用户/Assistant 文本发送给该模型的提供商,再把结果填入输入框。 - 模型润色只读取文本,不发送系统提示词、工具调用、工具结果、图片或 Assistant 推理内容;上下文最多 12 KB。处理中仅显示“模型润色中”。 - “自动发送转写结果”默认关闭。开启后,只有用户明确点击结束录音才会发送输入框原有文字与本次最终转写;浏览器自行结束识别时只把结果填入输入框。模型润色成功时发送润色结果,未选择润色模型或模型调用失败时仍发送原始转写。 Alpha 限制:当前 DSH 尚未为外部插件开放自定义辅助模型请求的 Session 日志事件。模型润色调用使用插件自己的受信 RPC,并不会写入 DSH Session 日志;上游提供相应扩展点后应迁移到可重建的日志事件。 构建与打包: 把生成的 tarball 安装到 Web profile,然后重启对应的 dsh web 进程: 当前 Alpha 版本面向 DSH 0.1.0-rc.6 。首次使用需要授予浏览器麦克风权限。

View full README on GitHub →
Tools / Devdsh-plugin

Category