WanYanTianDe/dsh-headroom

WanYanTianDe★ 0TypeScript最后同步: 2026-08-16

在 GitHub 打开

Headroom context compression for DeepSeek Harness: proxy lifecycle, compaction engine backend, CCR retrieve tool, settings card

README 摘要

dsh-headroom 给 DeepSeek Harness 装的"省钱引擎":对话太长时自动把旧内容压紧、大工具输出自动瘦身,少烧 token;需要细节时,模型还能自动找回原文。 非官方社区插件,与 Headroom Labs / DeepSeek 无隶属关系。 装它 方式一:npm 安装(推荐,已发布到 npm registry) 重启 dsh web 即可用,打开 设置 → 插件 能看到 "Headroom 压缩" 卡片。 方式二:从源码装(开发/本地修改用) 脚本会自动把插件装进 profile 并配好,然后 重启 dsh web 就能用。 手动装也可以,就两步: 用起来(什么都不用做) - 插件会自动准备好本地压缩服务(第一次会自动下载,稍等一会儿) - 对话变长后,旧内容会被自动压缩,省 token - 大工具输出(默认超过 8192 字符)也会被自动压缩 - 压缩不等于删除——原文都存着,模型需要细节时会自己取回 功能 组件 说明 代理生命周期 启动时探测 127.0.0.1:8787 ;无服务则自动发现 headroom 命令,缺失时经 uv tool install headroom-ai[all] 引导安装;然后 spawn headroom proxy ,等待健康后挂载 ctx.headroomClient 。设置变更时串行重启(复用不杀旧代理;启动配置变更强制换代理)。插件卸载时清理进程树。 历史压缩 对话 token 压力/溢出时,把选中的历史区间发给本地代理 POST /v1/compress ,压缩结果文本化为 checkpoint 写入会话。继承 harness 压缩后端全部机制(region 事务/压力触发/溢出恢复/持久化)。 工具输出压缩 每次模型请求前(step 边界),把超过阈值的大工具输出经代理压缩并影子替换为压缩文本;原文留在会话日志(可重建),模型可经 headroom retrieve 取回完整内容。无收益( 环境:headroom 0.35.0(OSS,Kompress ONNX 模型已加载)+ DeepSeek Harness web 会话。合成测量对真实代理 POST /v1/compress ;端到端为真实会话日志统计。 按内容类型的压缩收益(上限/下限) lossless 路径 (0.2.x,模型未启用时): 内容类型 压缩收益 角色 中文散文 52.6% 上限(upper bound) 英文/混合散文 24.3% 33% 上限 代码(AST 感知) 27.5% 高 复杂 JSON 17.8% 30.4% 中 日志 / 简单文本 0% 下限(lower bound) 重复 JSON -15%(变差) 下限:被 15% 门槛拦截,保留原文 Kompress(ML 有损)路径 (0.3.0 起,模型自…

在 GitHub 查看完整 README →
工具/开发dsh-plugin

分类