opensquad-ai/dsh-voice-input

opensquad-ai★ 0PythonLast synced: 2026-08-16

Open on GitHub

SenseVoice 语音输入插件 for DeepSeek Harness (dsh-plugin)

README excerpt

@opensquad/dsh-voice-input DeepSeek Harness 语音输入插件:在 Web 对话输入框旁添加一个麦克风按钮,录音后调用本地 SenseVoice 服务转写成文本,自动填入输入框。首次使用会引导下载模型并显示实时进度。 英文版 / English: README EN.md 功能 - 🎤 输入框旁麦克风按钮,一键录音转文字 - ⬇️ 首次使用自动下载模型(约 230MB),按钮上显示圆环进度 + 实时百分比 - ⚙ 独立管理按钮:查看/卸载已安装的语音模型 - 自动拉起本地 SenseVoice 服务(模型就绪时) 依赖 这是一个全自动插件:Python 后端(依赖安装 + 进程启动)由插件在 dsh 启动时自动完成,首次使用模型也自动下载。 你只需要: 前置 说明 Python 3.10+ 唯一需要手动装的软依赖(插件会自动 pip install 其余依赖) ffmpeg (可选/推荐) 仅用于异常音频的兜底转码,正常使用不需要; winget install ffmpeg 或官网安装并加入 PATH 手动安装 Python 3.10+ 插件会自动安装剩下的 Python 依赖(flask / onnxruntime 等),你只需装好 Python 本身。 1. 打开 python.org/downloads,下载最新的 Python 3.10+ (Windows 选 Windows installer (64-bit) )。 2. 运行安装程序, 务必勾选底部的 Add python.exe to PATH ,再点 Install Now 。 3. 安装完成后, 重新打开一个终端 (PowerShell / CMD),验证安装成功: 手动安装 ffmpeg(可选) 浏览器端会把录音转成标准 WAV,正常使用 不需要 ffmpeg。它仅在服务端收到异常/无法识别的音频时作为兜底转码使用,建议安装以免个别浏览器录音无法转写。 - Windows :在 PowerShell 里执行 安装完成后 重启终端 ,验证: - macOS (需先装 Homebrew): - Linux (Debian/Ubuntu) : - 通用方式 :也可访问 ffmpeg.org/download.html 下载,解压后把 bin 目录加入系统的 PATH 环境变量。 插件启动时自动完成: 1. 探测 Python → 自动安装 flask / onnxruntime / librosa / soundfile / pyyaml 等依赖(首次较慢) 2. 自动拉起下载网关( gateway.py :7102) 3. 首次使用 → 自动下载模型(约 230MB)并启动转写服务( service.py :7101) 安装插件 重启 dsh 后,插…

View full README on GitHub →
Tools / Devcordisdeepseek-harnessdsh-plugin

Category