humditty/dsh-quality

humditty★ 0TypeScript最后同步: 2026-08-15

在 GitHub 打开

Quality gate plugin for coding agents with automated tests, PASS/WARN/FAIL policies, and agent feedback.

README 摘要

DSH Quality 让 Coding Agent 在宣布完成之前,用可验证证据证明自己的工作。 Make coding agents prove their work before they declare it done. 为什么存在? Coding Agent 会理解任务、修改代码,然后说“完成了”。但“完成”首先只是模型对上下文的判断,不等于工程上的真实状态。 真实世界仍需要回答:代码能否构建?测试是否通过?改动是否引入回归?当前代码是否仍对应那次验证? DSH Quality 处理的正是这段差距:把 Agent 的主观完成声明,变成基于当前代码状态的可验证结论。 什么算完成? DSH Quality 不试图定义“什么是优秀代码”。它只判断: 当前项目声明的结束条件,是否已经由足够的验证事实满足。 一项可信证明至少要具备: - 相关 :与当前改动及其风险有关。 - 真实执行 :来自实际命令、工具或受信任的外部验证,而非模型猜测。 - 新鲜 :验证后相关代码没有再变化。 - 可追溯 :能知道验证了什么、针对哪个代码状态、由谁执行、结果如何。 因此,“之前跑过测试”不够;它必须能证明 现在这份代码 满足所需条件。 这是一个反馈闭环 当验证不足或失败时,DSH Quality 不只报告问题,还将可操作的反馈交给 Agent。Agent 修复后重新验证;重复失败则会停止自动循环,避免无止境消耗。 这就是项目的产品边界:增强 Agent “完成声明”的可信度。它不是代码生成器、CI/CD 平台、通用日志系统、Agent Benchmark 或聊天界面。 当前实现 当前仓库实现了这条闭环的可实践 v0.2,并保留 v0.1 CLI 作为兼容入口。此版本只解决四个能力: - Workspace Fingerprint :只支持 Git 工作区;指纹由 HEAD 、工作树状态、变更文件和内容哈希组成。 - Evidence Freshness :一次命令验证会记录命令、结果、输出、耗时与执行时的 workspace fingerprint;仅当 PASS 证据与当前 fingerprint 相同才复用。 - Failure Fingerprint :失败输出会去除时间、UUID、临时目录与 ANSI 噪声后再比较。 - Repair Loop Guard :最多 4 次修复、同一失败最多 2 次;停止时发送最后一条“如实报告未解决问题”的反馈,下一次结束允许 Agent 正常退出。 验证前后 fingerprint 不同会自动重验一次,避免把“验证本身改动了工作区”的结果误当作当前结论。命令运行同时支持取消、超时后的进程组终止和运行时日志截断。 当前尚未提供真实 DeepSeek Harness 的安装/注册包,也没有 affected-test、Lint、Cov…

在 GitHub 查看完整 README →
Agent/智能体agent-qualitycoding-agentdsh-pluginquality-gatetypescriptagent

分类