jinhuoooo/dsh-voice-input

jinhuoooo★ 0JavaScript最后同步: 2026-08-17

在 GitHub 打开

DSH 语音输入插件:点一下麦克风说话,文字自动进输入框。本地 Whisper 引擎,为打字小白设计。Voice-to-text plugin for DeepSeek Harness.

README 摘要

dsh-voice-input DSH(DeepSeek Harness)语音输入插件:点一下麦克风,说话,文字自己进输入框。 做给谁用的:打字慢、不方便打字、或者单纯懒得敲键盘的人。 我见过不少长辈和刚接触电脑的人,用输入法一个字一个字找拼音,一句话打完要半分钟。语音输入这东西对他们来说不是"效率工具",是"能不能用得起来"的问题。但现成的语音输入方案要么不准(中文稀烂),要么要翻墙,要么把音频传去别人服务器。这个插件就是把这事在本地解决掉。 它能做什么 - 在 DSH 聊天输入框旁边点麦克风, 说话,文字自动填进输入框 ,全程不碰键盘 - 中文识别靠谱:本地 Whisper 模型 + 强制简体输出 - 安静环境下不会"脑补":没说话就是没说话,不会突然给你冒出一段莫名其妙的话 - 全程本地跑:音频不出本机,不传云端,不要 API Key 也能用 - 国内网络友好:模型走 ModelScope 下载,不需要翻墙 优点(说点实在的) 1. 真的简单 。整个操作就两步:点麦克风 → 说话 → 再点停止。停止就是"确定",取消就是"不要了",没有第三个选项。界面是一个贴在麦克风按钮下面的小白卡片,不弹大窗口、不挡聊天内容。 2. 中文准,而且一定是简体 。识别完强制转简体(OpenCC),不会给你输出一堆繁体字让你再翻译一遍。默认模型 small,普通话日常口述够用;想要更准就改一行配置换 medium。 3. 不会乱说话 。Whisper 在音频太安静或噪音大的时候有个毛病:自己编一段话输出,比如你在咳嗽,它给你来一句"谢谢大家的关注"。这个插件加了防幻觉参数,静音就返回空、提示"未识别到语音",而不是给你塞一段编的。 4. 快 。模型只加载一次(常驻进程),之后每次转写毫秒级。不是每次点完等十秒转圈那种。 5. 隐私 。默认纯本地:录音在你电脑上,转写在你电脑上,只有文字进了 DSH。不想要本地也行,配置里填一个云端 API(Groq 免费)就能切过去,速度更快。 6. 不折腾网络 。模型从 ModelScope 下载,国内直连,装完一次以后不用管。 安装 前置条件 东西 要求 说明 DSH 任意可用版本 DeepSeek Harness 桌面端 Python 3.10+ 本地语音识别需要;首次使用会自动装依赖 麦克风 正常工作的麦克风 笔记本自带 / 外接都行 没有 Python 的话,去 python.org 下一个 3.10+ 装上, 安装时勾选 "Add Python to PATH" 。 方式一:从 GitHub 安装(推荐) 打开终端(Windows 用 PowerShell 或 CMD),执行: 如果你在 Web 界面模式下使用,把 web 换成你的 profile 名(一般就是 web )。 方式二:手动安装 1. 把本仓库整个下载解压,文件…

在 GitHub 查看完整 README →
工具/开发deepseek-harnessdsh-pluginspeech-to-textvoice-inputvoice-to-textwhisper

分类