Tom 文献雷达 · Agent + RAG + Long Context · 2026-09-29
本期概况
8 条候选,去重后 4 条高价值;补充 1 条 Substack 综述。无 CSDN。
🔴 高价值
1. TimeEvo: Failure-Driven Self-Evolution of a Time Series Agent
- 来源: arXiv 2609.27277 (2026-09-22)
- 标签:
agentmultimodal - 摘要: 时间序列 Agent 依赖人工预设工具,但人工选择与运行时需求存在系统性错配(Human-Agent Tool Misalignment);通用自修正会破坏 56/147 答案(Silent Harm)。TimeEvo 提出失败驱动自演化框架,在运行时判断工具有效性并自适应调整。
- 价值: Agent 工具选择自适应是今年 RAG + Agent 融合的核心问题之一;SFT/CoT 自修正的副作用此前被低估,本文量化了危害。
- 去向: 建议进 RAG/Agent 架构分支
2. Evaluating the Accuracy of KV Cache Reuse Techniques
- 来源: arXiv 2609.31415v1 (2026-09-25)
- 标签:
ragbenchmarksystems - 摘要: 当前 KV cache reuse 评测方法系统性高估了效果(依赖无法忠实反映精度损失的指标),且现有数据集不覆盖复用动态。本文提出无歧义评测方法并发布 Boxoffice 工具,可程序化生成复用场景。
- 价值: RAG + 长上下文推理系统化的核心底层问题;评测方法论本身有高引用潜力。
- 去向: 建议进 RAG 评测分支
3. SAGE: Mitigating Long-Horizon Reasoning Biases via Topological Guidance
- 来源: arXiv 2609.30192 (2026-09-23)
- 标签:
research - 摘要: 长程推理的两大偏差:探索偏差(局部合理但结构不稳定)和累积偏差(深层小偏差压制稀有奖励)。提出 Symbolic Closure Analysis(SCA),从拓扑视角刻画偏差并作为结构化推理的设计原则。
- 价值: 与长上下文模型的"lost-in-the-middle"问题高度相关;SCA 框架可迁移到 RAG 的文档图结构设计。
- 去向: 建议进 Long Context / Reasoning 分支
4. RAG in 2026: Is Retrieval-Augmented Generation Still Relevant?
- 来源: Command Code (Maham Batool) · 2026-05-20
- 标签:
综述hybrid - 摘要: 2024 年 DeepMind 论文已证明充足资源下长上下文平均性能超越 RAG,但 2026 年实践中 RAG 并未退场——根本原因是企业数据规模、推理成本、检索焦点优势仍存。文章认为未来架构是 retrieval + long-context orchestration 的混合,而非二选一。
- 价值: 社区层面最被引用的 RAG vs Long Context 2026 立场文之一;与本文 KV cache 评测论文结论互为补充。
- 去向: 建议进 RAG 综述/趋势分支
🟡 其他候选(去重参考)
| 标题 | 来源 | 标签 | 备注 |
|---|---|---|---|
| Disaggregated Quantization: Prefill/Decode 专业化 | arXiv 2609.26333 | systems | 预fill/decode 分离量化,Qwen3/Gemma3;非 RAG 核心 |
| Intent2Tc: Intent → Traffic Control 翻译 | arXiv 2609.31397 | networking | 偏网络 QoS,非 Agent/RAG |
📌 去重备注
- 本期无与近 7 天文件(
2026-09-28T2040-agent-rag-longcontext-radar等)重复的条目。 - Substack/Newsletter 补充:本期仅纳入 1 条来自 Command Code 的 2026-05-20 文章,结论与本期 KV cache 评测形成闭环。
Tom · 2026-09-29 08:40 · agent-rag-longcontext · 3x 雷达模式