Miiiuser/dsh-browser-agent
Miiiuser★ 1JavaScript最后同步: 2026-08-16
Browser automation + vision for text-only LLMs — standalone CLI + DeepSeek Harness skill + Cordis plugin. Drive a real browser with Playwright and give text-only models "eyes" via GLM / OpenAI-compatible vision.
README 摘要
dsh-browser-agent 给 纯文本模型(DeepSeek 等) 用的浏览器自动化 + 视觉识别。 用 Playwright 驱动真实浏览器(Edge / Chrome / Chromium),再通过视觉模型(默认智谱 GLM-4V ,也支持任意 OpenAI 兼容 / 本地模型)把截图转成文字,给文本模型装上"眼睛"。 提供 两种形态 : - 独立 CLI —— browser-agent - DeepSeek Harness Cordis 插件 —— 注册一组 browser 原生工具,会话内直接调用 不需要 Python,只需 Node 18+。 为什么需要它 browser-use 这类工具要求一个 多模态 LLM 当大脑。如果你用的是纯文本模型(DeepSeek 等),它看不到截图,就无法自己驱动浏览器循环。 本项目把职责按正确的方式拆开: 文本模型始终是决策者,视觉模型只负责"把像素翻译成文字"。 特性 - 常驻浏览器桥 —— 一个长驻浏览器走本地 HTTP API(登录态跨命令保持)。 - 文本优先定位 —— snapshot 返回元素清单(ref、tag、type、id、placeholder、text),多数操作不需要视觉。 - 按需视觉 —— see / vision 把截图或图片转成结构化描述。 - 三种视觉通道 —— glm (免费 GLM-4.6V-Flash / GLM-4.1V-Thinking-Flash)、 custom (任意 OpenAI 兼容端点)、 local (Ollama / LM Studio / llama.cpp)。 - 自动识别浏览器 —— 在 Windows / macOS / Linux 上找 Edge / Chrome / Chromium。 - 附加模式(attach) —— 通过 CDP 驱动已运行的浏览器(适合禁止启动浏览器的沙箱)。 - 结果缓存 —— 按"图片哈希 + prompt + 模型"缓存视觉结果。 快速开始(CLI) 或链接成全局命令: DeepSeek Harness Cordis 插件 plugins/cordis/ 里是一个 Cordis Host 插件,注册 10 个 browser 模型工具,让 DSH 会话 原生拥有 浏览器控制与视觉能力(无需再手敲 CLI)。 工具一览: 工具 作用 browser status 桥是否运行、当前页面 URL/标题 browser open 打开 URL browser snapshot 元素清单(ref 编号) browser text 页面可见文本 browser screenshot 截图保存 PNG browser click 按 ref / 文本点击 browser type 点击并输入 browser eval…
在 GitHub 查看完整 README →分类
A public gallery of animated pets for Codex, Claude Code, DeepSeek Harness, Hermes, OpenCode, Gemini CLI, and more.
★ 3,841
edison7009/EchoBirdOne-click install + model switch:Claude Code,Codex CLI (OpenAI), Grok Build (xAI), DeepSeek Harness, Kimi Code (Moonshot) ,Qwen Code,Aider,OpenCode,MiMo Code (Xiaomi),ZCode (Z.AI),OpenClaw,Pi,OpenScience,Vibe-Trading,Claude Desktop (3P profile),ChatGPT desktop,OpenCode Desktop,
★ 3,028
hyhmrright/brooks-lintAI code reviews grounded in 12 classic engineering books — decay risk diagnostics with book citations, severity labels, and 6 analysis modes including full-sweep auto-fix
★ 1,356