peterwangze/dsh-reasoning-level

peterwangze★ 1JavaScript最后同步: 2026-08-21

在 GitHub 打开

DSH (DeepSeek Harness) plugin: unified default reasoning level (thinking effort) for all models — per-model defaults with capability probing, live call statistics, one-command install via dsh plugin

README 摘要

dsh-reasoning-level DeepSeek Harness(DSH)统一推理等级插件: 一个设置项,动态管理所有模型的默认思考强度 ——含模型级默认与实时调用观测。 项目目标 DSH 接入的多服务商模型(DeepSeek 官方、智谱、聚合网关、自建中转……)对"思考强度 / 推理等级(reasoning effort)"的支持千差万别:有的模型选不了等级、有的只到 high 、有的支持 max ;手写声明的模型甚至不出现等级选项。逐模型手改 settings.yaml 既繁琐又容易把不支持的等级写进配置导致请求报错。 本插件把这件事收敛为 一处配置、动态生效、可观测 : - 统一默认 :全局一个默认等级,自动落到每条路由/每个模型(只在全部支持时写入,杜绝 UNSUPPORTED REASONING EFFORT ); - 能力补齐 :手写声明、没有推理能力元数据的模型自动获得等级声明(含实测可用的 max ),模型选择器立刻出现可选等级; - 模型级覆盖 : provider/model 粒度的独立默认,界面按 各模型实测支持等级 过滤选项; - 实时观测 :每次模型调用的实际等级、思考/输出 tokens、结束原因实时可见——设置不是空壳,效果全程可追溯; - 保守可靠 :显式选择永远优先;关闭开关即完整还原;用户手改的配置永不被覆盖。 等级优先级: 会话/模型选择器显式选择 模型级默认 全局默认 服务商自身默认 。 功能特性 - 手写模型自动补齐「推理等级」能力(含最大 Max——智谱 bigmodel 等网关实测接受 reasoning effort: max ) - 路由级默认等级(该路由全部模型支持时才写入) - DeepSeek 官方路由同步( llm-deepseek.reasoningEffort ,取 off/low/high/max) - 模型级默认: models: {"provider/model": level} ,界面按模型实测能力过滤可选项、探测结果标注、独立删除按钮 - 全路径注入 (v0.3.0):模型级默认不只对 agent-loop 会话生效——router 子代理 / session-title / compaction 等手建调用同样注入( llm/stream 未冻结请求注入) - 自愈降级 (v0.3.0):网关实测拒绝某等级( UNSUPPORTED REASONING EFFORT )自动记入黑名单,后续注入跳过,设置页明示 - 统计增强 (v0.3.0):每次调用耗时、流内思考字符近似(网关不回报 reasoning tokens 时仍可观测思考量)、来源(sessionId/purpose) - 同步默认 agent 模型 (v0.3.0): syncDefaultAgent 开启时全局等…

在 GitHub 查看完整 README →
工具/开发deepseekdeepseek-harnessdshdsh-pluginllmpluginreasoning-effort

分类