detpecca/LLM-Wiki

detpecca★ 3Python最后同步: 2026-08-17

在 GitHub 打开

Independent implementation of “Retrieval as Reasoning” (LLM-Wiki)

README 摘要

LLM-Wiki(论文实现) 对论文 《Retrieval as Reasoning: Self-Evolving Agent-Native Retrieval via LLM-Wiki》 (arXiv:2605.25480)的独立实现:把文档 编译 成带双向链接的结构化 Wiki,查询时由 Agent 组合 wiki search / wiki read 进行遍历推理,并通过 Error Book 实现持久的自我纠错。 安装 唯一运行时依赖是 pyyaml (LLM 调用走标准库 urllib)。 配置 LLM OpenAI 兼容接口均可,环境变量三选一配置: 本地模型(Ollama 等): LLM WIKI BASE URL=http://localhost:11434/v1 。 使用 ( --wiki 是全局参数,需放在子命令之前。) 读/修复类命令( ingest / search / read / stats / validate / fix / errorbook )都支持 --json ,供 DeepSeek Harness 插件(dsh-llm-wiki)以子进程方式驱动。 delete 是破坏性的知识库管理, 刻意只留给人工使用 ,不提供 --json 、不暴露给 Agent。 无 API key 时可跑脚本化端到端演示(编译本论文自身 + 多跳查询): 论文 → 代码 映射 论文 实现 算法 1 索引期编译(附录 D) llm wiki/compile.py ( Compiler.compile passage 逐行对应) 页面 Schema(附录 E) llm wiki/schema.py + store.py (frontmatter + 三个必备章节 + 双向 wikilink) 7 类错误分类(附录 F) llm wiki/validators.py (5 类确定性 + 2 类 LLM 验证) Error Book 五阶段(§3.3) llm wiki/error book.py (Discover→Attribute→Constrain→Inject→Verify&Close) 双层修复(§3.3) code autofix / llm periodic fix / finalize (3 轮循环) wiki search/wiki read(§3.2) llm wiki/search.py (结构化信号优先)+ store.read many 遍历策略与终止(§3.2、附录 H) llm wiki/agent.py (Tmax=15,P=3,作答前至少一次 wiki read) 超参数(论文 §4.4) T max=15 (工具调用预算)、 P=3 (连续空搜索耐心阈值)、 k=5 (SelectPages 上限)、每 10 …

在 GitHub 查看完整 README →
工具/开发dsh-pluginagentsearch

分类