YOGEMOW/DeepSeek_Prism

YOGEMOW★ 3JavaScriptLast synced: 2026-08-15

Open on GitHub

为纯文本模型按需识图:DSH 零补丁 Cordis 插件(prism_see 工具 + 图片 VEP 降级 + 技能运行时注册)+ Codex Skill;多 Provider 视觉 API,VEP/1 低 Token 视觉证据包

README excerpt

DeepSeek Prism 为纯文本 DeepSeek 模型(如 deepseek-v4-flash )提供按需识图能力的 Codex / DeepSeek Harness(DSH)双平台 Skill:图片由外部视觉 API 提取可见事实,压缩为低 Token 的 VEP/1 视觉证据包回传主模型,由主模型继续完成推理、规划与决策。 版本选择 版本 定位 说明 v0.7.1 零补丁版 DSH 当前主线:自包含 Cordis 组合包, prism see 工具 + 纯文本模型图片准入 VEP 降级 + 技能运行时注册 + 设置卡片;harness 本体零改动、上游更新零冲突、卸载零残留 v0.6.2 实用版 DSH 完整 UI 体验:原图保留展示 + VEP 折叠链接/识别进度卡片 + Web 设置卡片可编辑;需应用 harness-patch/dsh-prism-harness.patch (可选增强) v0.2.0 Codex 推荐 skills 版 Codex 平台的技能本体(SKILL.md + scripts/vision.mjs + references),安装到 /.codex/skills/deepseek-prism 功能 - 强制触发协议:主模型无法直接读图(Unsupported format / 无法读取 / binary)时,立即调用 scripts/vision.mjs 识图。 - VEP/1 紧凑证据:默认输出 ≤520 字符(约 50–150 tokens),字段按优先级裁剪。 - --detail 五模式分节报告:页面还原(A1–A7)/ 问题定位 / 报错日志 / 文本表格 / 图表数据。 - 自动分级:小图/简单任务默认 VEP/1;长内容(代码截图、长日志、文档、宽/高比大的图)自动走 --detail 完整通道;超长内容自动续写并合并。 - 程序化输出: --raw 输出清洗后的原文; --full 输出 {raw, parsed} JSON 信封。 - 输入预处理:解析图片宽高(含 AVIF/TIFF/SVG 的 sharp metadata 回退),超过 2048px 时用 sharp(libvips)等比缩放后再上传,不依赖宿主安装 Python 等工具;sharp 自动查找 Codex 桌面运行时 / DSH Web 运行时( /.dsh/profiles/node modules/sharp )/ 技能目录 node modules/sharp (或 VISION SHARP PATH 指定);动画 GIF 缩放后保留全部帧,AVIF/TIFF/SVG 统一转为 PNG 保证视觉 API 兼容。 - 多 Provider 预设与自动降级:SiliconFlow(测试首选)/ 智谱 / ModelScope …

View full README on GitHub →
Media / Contentaideepseekdsh-pluginocrvision

Category