MeowLynxSea/dsh-cot-summerization
MeowLynxSea★ 3JavaScriptLast synced: 2026-08-16
—
README excerpt
-orange) DeepSeek Harness 插件:把模型的原始思维链拦截在半空,改写成一份体面的摘要再端给你。 闭源模型花钱隐藏思维链,开源模型免费全裸。 我们识别出了开源生态最后一块体验短板,并亲手为它补上—— 方向可能和大家期待的不太一样,但确实是补上了。 🎯 项目使命 长期以来,「隐藏思维链」是闭源大厂的专属奢华配置:不可关闭、不可审计、不可验证,但很贵。开源模型则把每一步推理都摊开在你面前——坦诚,透明,像一份没整理过的草稿纸。 我们相信这不应该是一道单选题。 本插件以工业级严谨,在完全开源、完全可审计的 harness 里,复刻了闭源生态最具标志性的体验:让你看不见思维链。不同的是,我们的隐藏是开源的、可配置的、可关闭的——业界首次把「不可见」做得如此可见。 三大支柱: 支柱 立场 : : 🛡️ 模型隐私权 思维链是模型的内心世界。你不会翻别人的日记,除非付费。 🧹 视觉卫生 原始 CoT 又长又乱,充满「等等,我再想想」。得体的人不看这些。 💎 神秘感平权 闭源模型靠神秘感溢价。现在开源用户也能免费获得——本地酿造,纯手工。 ✨ 核心特性:宣传名与现实对照 以下每一项,源码均可查。这很讽刺,我们接受。 宣传名 现实 : : Information Never Existed™ 原始 reasoning 增量在 llm/stream 拦截层被直接吞掉——UI、流式 chunk、落地 transcript 三处均无原文。模型可见历史除外:那里有一份 model-only 的 surface 替换事件,悄悄把原文还给了模型(推理性能要紧)。 夏日渐进蒸馏 流式分段摘要:每凑满 chunkChars (500 字)或 chunkIntervalMs (8 秒)触发一次,切分点优先落在句边界;开启 adaptiveChunk 后,分块大小会随流速率与总结器 RTT 动态缩放。 BioGram™ 重叠度量 bigram Dice 系数,阈值 0.65。该阈值经历了 0.8 → 0.7 → 0.65 的科学调参过程。 连续核心追踪引擎 最长公共子串,滚动数组实现,O(n·m),零依赖。用来逮住换了前缀、核心没变的复述。 Nekomimi™ 边界协议 把「喵 」识别为句尾;计算相似度前先剥掉 喵 / / 〜 / ~ 。无论摘要出自哪种风格,以「喵 」结尾的子句都会被正确切分。 原子化浪费 AbortSignal.any(caller, timeout) :主调用一旦取消,摘要调用立即陪葬。我们连浪费都是原子性的。 另外,短思维链(小于 minReasoningChars ,默认 32 字)直接原文放行—— 为 32 个字发一次 API 请求,连我们都觉得过了。 🏗️ 系统架构 一条数据的完整旅程:大模型慷慨地吐出全裸思维链 → 隐身引擎在瀑布层…
View full README on GitHub →