hige6/imgpost
hige6★ 1JavaScript最后同步: 2026-08-15
图邮 (imgpost):让你的 DSH 能发图给你 —— 本地图片、网页图片、AI 生图,一键发进对话里。
README 摘要
图邮 imgpost 让你的 DSH 能发图给你 —— 本地图片、网页图片、AI 生图,一键发进对话里。 imgpost 是一个 DeepSeek Harness (DSH) / Cordis 插件,提供两个模型工具: 工具 作用 send image 把 http(s) URL / base64 data URI / 本地文件路径 的图片送入对话,持久化到附件库并内联渲染 generate image 调用 任意 OpenAI 兼容的 /images/generations 生图接口 ,生成图片后直接发进对话 为什么需要它 - Markdown 只支持渲染 http(s) 绝对 URL 的图片——本地文件路径( E:\...\a.jpg )浏览器出于安全限制无法直接显示。 - imgpost 把图片字节 落盘到 DSH 附件库 ( /.dsh/attachments/ ),再通过同源的 /dsh-img2/ HTTP 路由供浏览器拉取,URL 永久有效。 - 生图 API 的返回( data[].url 或 data[].b64 json )也会被自动下载、落盘、转成稳定 URL。 安装 把插件目录挂到 DSH 的 profile 组合层。以 web profile 为例: 重启 DSH 后, send image 和 generate image 会出现在模型工具清单里。 注意: name 必须指向插件的 入口文件 ( src/host.js ),不能是目录——DSH 的 loader 不支持 ESM 目录导入。 生图配置 二选一: 方式一:配置文件 /.dsh/image-sender.json (推荐) 方式二:环境变量 优先级:环境变量 配置文件。生图时也可用 model 参数临时覆盖。 兼容的服务商 只要端点形如 POST {baseURL}/images/generations 且返回 data[].url 或 data[].b64 json 即可: 服务商 baseURL 模型示例 Agnes AI https://api.agnes-ai.cn/v1 agnes-image-2.1-flash 智谱 AI https://open.bigmodel.cn/api/paas/v4 cogview-4 SiliconFlow https://api.siliconflow.cn/v1 black-forest-labs/FLUX.1-schnell 阿里云百炼 https://dashscope.aliyuncs.com/compatible-mode/v1 wanx-v1 OpenAI https://api.openai.com/v1 gpt-image-1 使用方法 调用工具成功后, 模型必须在回复里插入 markdown 图片语法 (工…
在 GitHub 查看完整 README →分类
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全网第一个 DeepSeek Harness 视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。
★ 1,700
Anionex/agent-vision-toolkit为纯文本模型"看图“设计更好的视觉工具箱和技能,支持多图理解,图片问答,前端UI还原、GUI 自动化等,并可选无缝接入多个主流agent,直接识别粘贴图片| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode
★ 884
Anionex/dsh-vision-toolkit让纯文本模型更好地做视觉任务的DeepSeek Harness插件:带意图的图片问答、长截图 OCR、UI 还原等|DeepSeek Harness-native integration for agent-vision-toolkit: image Q&A, long-screenshot OCR, UI restoration, grounding, pixel diff, Artifacts, and Web UI.
★ 405