cyh12345678910/dsh-vision-bridge

cyh12345678910★ 0JavaScript最后同步: 2026-08-19

在 GitHub 打开

Multi-backend vision plugin for DeepSeek Harness — API (OpenAI Vision) + CDP (Doubao bridge), cross-platform, cached, configurable

README 摘要

dsh-vision-bridge 让没有视觉能力的 DSH 模型"看见"图片 —— 多后端、跨平台、带缓存的 DeepSeek Harness 宿主级插件。 基于 doubao-vision-dsh 重写,修复了原插件的核心问题并大幅扩展。 为什么重写 原插件 doubao-vision-dsh 解决了一个真实问题——让纯文本模型"看见"图片——但有以下严重缺陷: 问题 原插件 本插件 硬编码用户路径 C:\Users\20105\... (作者自己的路径) 动态解析 homedir() + DSH HOME 平台限制 仅 Windows(taskkill, cmd.exe) Windows / macOS / Linux 视觉后端 仅豆包(CDP) 多后端:SiliconFlow / OpenAI Vision API + CDP 桥接 错误处理 大量 catch (e) {} 吞错误 有意义的错误信息 + 日志 缓存 仅会话内内存缓存 持久化缓存(内容哈希,磁盘+内存) 配置 全部硬编码常量 通过 cordis.patch.yml 配置 标准化 非标准(手动复制文件) npm 包 + package.json 功能特性 - 多后端 :支持 SiliconFlow(DeepSeek-OCR,免费)、OpenAI-compatible Vision API 和 CDP 桥接(豆包等桌面应用) - 跨平台 :Windows、macOS、Linux 全支持 - 动态路径 :自动解析用户目录,不硬编码任何路径 - 持久缓存 :图片识别结果按内容哈希缓存,重复识别零延迟 - 可配置 :后端类型、API key、超时、缓存大小等全部可通过 cordis.patch.yml 配置 - 全预设生效 :挂在用户补丁层,任何 preset、任何对话自动可用 - 图片照常显示 :聊天界面正常显示图片,界面无多余标记 - 停止可取消 :识别是标准工具调用,"停止"按钮立即中断 - 纯文本模型安全 :适配器层剥离图片块,图片内容永远不到达模型请求 - 图片归档 :每张图片复制到 attachments/collected/ (日期 哈希.ext),按内容去重 - LLM 运行时 patching :patch resolveModelInfo + listModels + stream + registerAdapter ,确保前端接受图片上传、模型不收到图片块、新注册适配器也被 patch 快速开始 前置条件 - DeepSeek Harness (DSH) 已安装 - 选择一种视觉后端: - SiliconFlow + DeepSeek-OCR(推荐,免费) :注册送额度,DeepSeek-OCR 模型免费,1-2 秒响应 - API 后端 :一个 OpenAI-compat…

在 GitHub 查看完整 README →
内容/媒体cdpcordisdeepseek-harnessdsh-pluginmultimodalocropenai-visionvision

分类