duyefeng/dsh-browser
duyefeng★ 1JavaScriptLast synced: 2026-08-14
给 DeepSeek Harness 的浏览器插件:AI 直接开真实的 Edge 浏览器逛网页、点击、填表、截图,无需 CDP 或 MCP。
README excerpt
dsh-browser 给 DeepSeek Harness 用的浏览器插件。装上之后,AI 就能直接开一个真实的 Edge 浏览器去逛网页、点按钮、填表单、截图—— 不用配 CDP、也不用跑 MCP ,装完就能用。 底层是 Playwright,直接驱动你电脑上已经装好的 Edge,所以页面行为和真人浏览完全一致(cookie、JS、登录态都在)。 怎么用 一行命令安装: 然后启动: 小提醒:装完之后要 重启 一下 profile。插件是在启动时读取的,光重启不 add 等于没装。 装好之后,直接在对话里说人话就行,比如: - “打开 example.com,读一下正文,告诉我标题” - “打开百度搜‘天气’,把第一条结果的标题给我” - “打开这个登录页,填好账号密码,截个图给我看” AI 会自动调用对应的浏览器工具。 有哪些工具 工具 干嘛的 browser navigate(url) 打开网址 browser snapshot() 读取当前页面(标题、正文、可点元素) browser click(selector) 点击某个元素 browser type(selector, text) 往输入框里填字 browser press(key) 按键盘(Enter、Tab、Esc…) browser evaluate(expression) 在页面里跑一段 JS browser screenshot() 截图,返回图片路径 browser close() 关掉本次会话的浏览器 想改默认行为 在 profile 自己的 cordis.patch.yml 里覆盖 browser 这一行就行: 环境要求 - Node.js 22+ - 装了 Microsoft Edge(没有其他浏览器也行,就是需要 Edge) - 有 dsh 命令行(或源码 checkout 里用 pnpm dsh ) License MIT
View full README on GitHub →Category
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全网第一个 DeepSeek Harness 视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。
★ 1,123
Anionex/agent-vision-toolkit为纯文本模型"看图“设计更好的视觉工具箱和技能,支持多图理解,图片问答,前端UI还原、GUI 自动化等,并可选无缝接入多个主流agent,直接识别粘贴图片| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode
★ 794
Anionex/dsh-vision-toolkit让纯文本模型更好地做视觉任务的DeepSeek Harness插件:带意图的图片问答、长截图 OCR、UI 还原等|DeepSeek Harness-native integration for agent-vision-toolkit: image Q&A, long-screenshot OCR, UI restoration, grounding, pixel diff, Artifacts, and Web UI.
★ 298