C-4-C-4/dsh-vision-bridge

C-4-C-4★ 0TypeScriptLast synced: 2026-08-15

Open on GitHub

让 DeepSeek 模型获得图像理解能力

README excerpt

dsh-vision-bridge(识图插件) 一个常驻型 DeepSeek Harness 插件,让纯文本的 DeepSeek 模型获得 图像理解能力 :在聊天框上传图片(回形针按钮或拖拽),插件会调用你配置的视觉模型 API(OpenAI 兼容或 Google Gemini),将识别出的文本回填到对话中,让 DeepSeek 能够回答关于图片的问题。 这是动态插件的 常驻、开源版本 ——一个真实安装到 DSH 配置文件中的包:配置可跨重启保留(存储于 $DSH HOME/settings.yaml ),UI 使用 DeepSeek Harness 原生组件库( dsh-client-ui-primitives )与主题令牌( --dsw- ), 不使用任何 emoji ——所有图标均为原生 DSH SVG 图标。 功能特性 - �️ 输入框工具栏中的回形针上传按钮,悬停显示提示 - 📥 在聊天区域任意位置拖拽上传图片 - 🧠 通过配置的视觉模型自动识别(支持 任何 OpenAI 兼容端点 ——智谱 GLM / 通义千问 VL / Moonshot / 硅基流动 / Ollama——以及 Google Gemini ) - 📋 输入框上方的宽幅预览卡片:缩略图、文件名 + 大小、状态、可展开的识别结果、操作按钮(插入输入框 / 插入并发送 / 重新识别 / 删除) - 🔌 模型可调用的 vision lookup 工具——DeepSeek 可在对话中主动询问已上传图片的信息 - ⚙️ 配置卡片位于 设置 → 插件 → 插件配置,并提供"测试连接"按钮 - 💾 配置通过 settings 服务持久化( $DSH HOME/settings.yaml ) 环境要求 - DeepSeek Harness Web 模式(浏览器 UI;插件使用 webServer 、 settings 、 subprocess 与 tools 主机服务) - Node.js ≥ 20 及一个包管理器(推荐 pnpm)用于构建 - 一个属于自己的视觉模型 API 密钥(OpenAI 兼容或 Gemini) 构建 产物: lib/index.js (主机端)与 lib/client.js (浏览器端 bundle)。 安装到 DSH 配置文件 1. 将整个包复制到配置文件的 node modules 中,例如默认的 web 配置: ( $DSH HOME 通常为 /.dsh ,例如 C:\Users\你的用户名\.dsh 。) 2. 在该配置文件的 cordis.patch.yml (与 cordis.yml 同级、在每次 bundle 层之后应用的文件)中注册插件行。追加一条 insert 条目——单行即可同时激活两端:主机加载器加载 lib/index.js (Node …

View full README on GitHub →
Tools / Devdshdsh-plugindsh-pluginsvision

Category