wjxn13/dsh-headroom

wjxn13★ 3TypeScriptLast synced: 2026-08-15

Open on GitHub

Headroom context-compression proxy integration for DeepSeek Harness: detect/install/start Headroom, auto-configure the DeepSeek compressed route, one-click route-switch UI. Built on headroomlabs-ai/headroom (Apache-2.0).

README excerpt

dsh-headroom DeepSeek Harness 的 Headroom 上下文压缩代理集成插件:一键检测、安装、启动 Headroom 压缩代理,并自动接入 DeepSeek 线路(OpenAI 协议),在设置页提供状态面板与切换控件。 重要声明 :本插件是 headroomlabs-ai/headroom (Apache License 2.0)的 集成与封装 ,Headroom 压缩引擎本身由 Headroom 项目提供, 版权归其作者所有。本插件不包含、也不修改 Headroom 的压缩算法,仅负责: 环境检测、依赖安装、进程管理、DeepSeek 兼容预设与线路切换 UI。 详见 NOTICE 与 LICENSE。 功能 - 一键启用压缩线路 :设置页点按钮,把 DSH 的 llm-deepseek.baseURL 指向本地 Headroom 代理 - 自动环境管理 :检测 Python → 自动建 venv → 安装 headroom-ai[proxy] (轻量,无 torch) - 进程守护 :自动启动 headroom proxy、 /livez 健康检查、崩溃提示 - 兼容预设 :固化 Windows workaround( HEADROOM DETECT BACKEND=python 、 HEADROOM TOOL SEARCH=off )与 DeepSeek 双协议路由 - 一键切回直连 :任何时刻可切回 api.deepseek.com ,无锁死风险 - 实时统计 :设置页显示花费/节省 token、缓存命中率(每 10 秒刷新) 实测成果 以下数据来自本机真实使用(DeepSeek V4-Flash,DSH 大上下文会话),2026-08-15 统计: 指标 实测值 说明 累计压缩节省 1,256,265 token Headroom 累计压缩掉的 token(跨 1,533 次请求) 累计输入 413M token 压缩后实际发送量 缓存命中率 99.9% 前缀缓存命中(DeepSeek 官方机制,Headroom 不破坏它) 单请求典型节省 4-71 token / 请求 工具 schema 压缩为主(大上下文会话) 能省多少?(诚实预期) Headroom 官方宣称可省 60-95% token(JSON 数据)或 15-20%(编码 agent),但 实际节省取决于场景 : - JSON/结构化数据密集 (工具输出、API 响应):压缩空间大,接近官方宣称的高端 - 大上下文 coding 会话 (DSH 这类 1M 上下文,实测 2026-08): 大多数请求只省 0.001% (工具 schema 早已压缩、历史走缓存,可压缩空间被榨干);但当工具输出/跨轮去重触发时,单次可省 8-20% 甚至更高(实测平均 8…

View full README on GitHub →
Fun / Adscontext-compressiondsh-pluginheadroomsearch

Category