fightingFirefox/dsh-glm-vision

fightingFirefox★ 0JavaScript最后同步: 2026-08-21

在 GitHub 打开

在dsh中接入智谱 GLM 视觉模型,让 DeepSeek 等文本模型通过 glm_vision 工具看图。

README 摘要

dsh-glm-vision GLM 视觉模型 插件:把智谱 glm-4.6v 系列视觉模型以独立供应商路由的形式接进 DeepSeek Harness,并提供一个 glm vision 工具,让 DeepSeek 等文本主模型「动脑」、GLM「当眼睛」 。 1. 注册供应商路由 glm-vision (openai-completions 直连 https://open.bigmodel.cn/api/paas/v4 ) - 内置模型目录: glm-4.6v / glm-4.6v-flash (永久免费)/ glm-4.6v-flashx / glm-4.5v / glm-5v-turbo - 每个模型都声明 input: [text, image] ,可直接处理图片输入 - 路由注册后:模型选择器可选、任何插件可用 ctx.llm.stream({ provider: 'glm-vision', model: 'glm-4.6v', messages: [...含 image 块...] }) 调用 2. 注册模型可见工具 glm vision - 参数: image (本地图片路径)、 question (可选)、 model (可选)、 maxTokens (可选) - 流程:读文件 → 存入附件服务 → 图片块进 GLM → 返回文字描述 - 主模型无需支持图片输入即可用它看图 安装 - 已安装 DeepSeek Harness 本体( @deepseek-ai/dsh ),命令行里有 dsh 命令 - 一个智谱开放平台(open.bigmodel.cn)的 API Key 安装插件 装完后插件自动加入 profile 的 bundles 层 配置 API Key 1. 到 https://open.bigmodel.cn 注册并创建 API Key 2. 在 DSH Web 的 设置 → Models 页面填写,或直接编辑 $env:USERPROFILE\.dsh\.credentials.yaml : 重启生效 配置 插件带有浏览器半边: 设置 → Plugins → Plugin config 里会出现「GLM 视觉(智谱 bigmodel.cn)」卡片,可直接改这些字段(保存即生效, registerTool 改动需重启): - defaultModel — glm vision 缺省模型(下拉选择 5 个 GLM 视觉模型) - baseURL — 接口地址(默认 https://open.bigmodel.cn/api/paas/v4 ) - apiKeyEnv — 凭据引用名(默认 ZAI API KEY ) - maxTokens / timeoutMs — 输出上限(含思考预算)/ HTTP 超时 - thinking — 思考…

在 GitHub 查看完整 README →
内容/媒体deepseek-harnessdsh-pluginglmmultimodalvisionzhipu

分类