oldHan2423/dsh-image-auto-describe
oldHan2423★ 0JavaScript最后同步: 2026-08-18
—
README 摘要
贴图自动识别(dsh-image-auto-describe) 中文 English 让「不会看图」的 DeepSeek 也能看懂你发的图片。 一句话:你往对话里贴一张图,这个插件先让一个看得懂图的视觉模型把图片内容读成文字,再把这段文字交给 DeepSeek 继续回答——全程自动,不需要你做任何额外操作。 它解决什么问题 DeepSeek Harness 里很多主力模型(比如 deepseek-v4-pro)只处理文字。默认情况下,你贴图发消息会被直接拒绝: 这个插件把「拒绝」换成「理解」: 实际用起来的效果: - 截图里的报错、日志、表格、聊天记录,图上的文字会被 逐字摘录 ,可以直接接着讨论 - 识别结果会注明是哪个视觉模型识别的,原图在对话里保留可点开对照 - 识别中对话里会出现一个低调的「正在识别图片…」状态,识别完自动变成正式消息 - 所有视觉模型都失败时,退回原来的「不支持图片」提示, 不会假装看懂、不会胡编 注意 :DeepSeek 看到的始终是「文字描述」,不是图片本身。视觉模型没写到的细节,DeepSeek 也无从知道——但这已经覆盖了绝大多数「发截图问问题」的场景。 安装 可从插件市场安装,或一条命令: 包声明了 dsh.bundle.patch , dsh plugin 会自动把它接入 profile 补丁层;profile 自己的 cordis.patch.yml 仍可按 id 覆盖该行。 宿主补丁(装完必做一次) 官方 apiproxy 目前没有公开的图片准入接口,「拒绝贴图」的逻辑是写死的。本仓库附带一个幂等补丁,把那个拒绝点改成这个插件提供的「转写放行」。装好后执行一次(或 Harness 升级恢复原文件后重跑一次): 补丁改动两处: dsh-host-apiproxy/lib/index.js 里的一处拒绝分支,以及向它的 api barrel 注入 IMAGE AUTO DESCRIBE SERVICE 常量。锚点针对 0.1.0-rc.6 的源码形态;版本对不上时报 MISS 且不做任何修改,绝不硬改。每次执行都会用 node --check 复核被改的文件。打补丁后重启 Harness 宿主生效。 要求 - DeepSeek Harness 0.1.0-rc.6 (补丁锚点版本;更新版本的锚点未跟进前会报 MISS )。插件把官方 @deepseek-ai/ 包作为对等依赖(peer dependency)解析;profile 必须已组合这些包。 - 视觉路由必须已存在于组合好的 llm 能力中——例如由 llm-pi-ai 插件注册的提供者。默认值期望 siliconflow (Qwen/Qwen3-VL-32B-Instruct)与 zhipu (glm-4v-flash),且各自 API Key 已配置。 配置 …
在 GitHub 查看完整 README →分类
DeepSeek Harness: Everything is a Plugin.
★ 182,325
amruthpillai/reactive-resumeA one-of-a-kind resume builder that keeps your privacy in mind. Completely secure, customizable, portable, open-source and free forever. Try it out today!
★ 41,477
anywhere-labs/deepseek-harness-desktop为 DeepSeek Harness (DSH) 插件生态打造的现代化桌面端解决方案。万物皆「插件」,桌面本身也是「插件」。
★ 17,784