SpookySandwich/dsh-plugin-rollout-scout
SpookySandwich★ 3JavaScript最后同步: 2026-08-22
DSH 刷灰测模型插件。DeepSeek Harness plugin: fish for a limited-rollout conversation model by scoring live chain-of-thought.
README 摘要
dsh-plugin-rollout-scout English 简体中文 服务商有时会灰度发布新的对话模型,你分到哪一个全看运气。灰度侦察会用你自己的账号开启一批临时会话, 在思维链流式输出的同时 读取它,并按「推理是怎么写的」打分——读起来像你手上这个旧模型的立刻中止,不像的留下来。 它是基于措辞的启发式小工具,不是权威判据。它做的每件事你都可以手动完成:开一个新会话、扫一眼思维链、关掉。 判定方式 信号在于 每个段落是怎么开头的 ,而不是某个短语在全文出现了多少次。若按全文累计,「Let me」会单纯因为篇幅变长而越积越多,一段本来很好的长思维链最终也会被判为差。只看开头,度量才稳定。 每段只读前 48 个字符。而关键短语往往并不在第 0 个字符: The directory is empty. Let me create a 3D cyberpunk scene. To avoid conflicts, I'll keep I18n.cs edits under one change. 有两个决定性信号,且刻意 不对称 : 信号 效果 任意段落以 Let me 开头 旧模型——立即中止该轮 整条思维链 以 I'll 开头 灰度模型——放行跑完并保留 I'll 只有出现在最开头才算证据:旧模型也会在 中间某段 写「I'll create a single HTML file…」,然后隔几段又说「Let me build…」。把每个 I'll 都当证据会造成误判。 两者都没触发时,其余开头进入评分: 段落开头写满 48 个字符就会打分,即使模型从不换行。后出现的 Let me 会推翻 先前的保留。 灰度链路常常用一个 小模型总结思维链 。总结模型经常以 We need to… 开头(所以段首 we 只记负分,不直接判死),写出 规整、一段一段的长段落 ,并且 输出一阵、卡住、再输出一阵 。这三条都是新链路的正面证据。旧模型不规律——整段糊成一块,或夹着很短的 Let me 行。 正向开头是第一人称 单数 的计划语气—— I'm 、 I am 、 I've 、 I have 、 I need 、 I think 、 I also 、 I will ,以及位于开头的 For 。负向开头是 Let me / Let's ,以及开头里出现的 任何 第一人称复数( we 、 we need 、 we will 、 we'll …)。灰度模型用 “I”,不用 “we”。加一的先验让证据稀少时分数停在 50% 附近,不会因为一个词就给出自信判断: 证据 置信度 判定 暂无 50% 继续观察 1 正 / 10 负 15% 丢弃 5 正 / 0 负 86% 保留 低于 低于此分即丢弃 (0.35)丢弃,高于 高于此分即保留 (0.7)保留,但都要先累计到 最少开头数 (4…
在 GitHub 查看完整 README →分类
DeepSeek Harness: Everything is a Plugin.
★ 183,476
amruthpillai/reactive-resumeA one-of-a-kind resume builder that keeps your privacy in mind. Completely secure, customizable, portable, open-source and free forever. Try it out today!
★ 41,499
anywhere-labs/deepseek-harness-desktop为 DeepSeek Harness (DSH) 插件生态打造的现代化桌面端解决方案。万物皆「插件」,桌面本身也是「插件」。
★ 18,022