Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-07-28 14:40 UTC
概览
- 主题:Agent + RAG + 长上下文 + 检索评测
- 来源:arXiv(2026-07-27)+ HuggingFace Daily(2026-07-26)
- Substack 线索:1 条(见末节)
★ 高价值条目(3 条)
1. APS-RAG:面向大科学设施的修正型 Agentic 混合 RAG + 运营评测
- 来源: arXiv 2607.24663(2026-07-27)
- 机构: Advanced Photon Source(美国阿贡国家实验室同步辐射设施)
- 核心: 三路融合检索(dense + sparse + knowledge graph),加校正 Agent修正幻觉;附运营场景 ground-truth 评测集(非学术 benchmark)
- 标签:
agentragbenchmarksystems - 价值: 首个面向真实运营知识(电子日志/控制数据/维护记录)的大规模 RAG 部署案例;评测设计直接对接 OPEX,值得参考
2. DeCoRAG:复杂文档理解的认知解耦 + 语义感知切分
- 来源: arXiv 2607.24554(2026-07-27)
- 核心: 多模态 Graph RAG 在视觉密度高/结构稀疏文档(如金融图表)中 token 开销过高问题;提出认知解耦 + 语义切分策略,在保证准确率同时削减 token
- 标签:
ragbenchmarkmultimodal - 价值: 多模态 RAG 的效率-准确率权衡是 2026 年工程落地核心痛点;本文直接针对该问题
3. Physics of Multi-Turn Long-Horizon Planning:从预训练到 Agentic 蒸馏
- 来源: arXiv 2607.24720 / HF(2026-07-26)
- 核心: 在可控多轮环境(显式世界模型 + CoT 状态转移)中系统研究规划能力如何获得;覆盖预训练数据格式/分布/质量,以及单/多教师蒸馏路径
- 标签:
agentsystems - 价值: 少见的"从原理出发理解规划能力"的系统性工作;多教师蒸馏框架对 Agent 训练有直接参考价值
📋 候选条目(4 条)
4. Agentic RAG + 历史档案知识图谱可验证访问
- 来源: arXiv 2607.24475(2026-07-27)
- 核心: Agentic 检索系统访问历史档案时引入可验证性 + 可问责层,解决 LLM 幻觉在档案场景的 accountability 问题
- 标签:
agentragbenchmark
5. RAG 用于历史文献修复:LLM + 外部历史知识融合
- 来源: arXiv 2607.21936(2026-07-23)
- 核心: MASK-LM 方法无法恢复专名实体;用 RAG 引入外部历史知识辅助修复,ARI 模型验证有效
- 标签:
ragbenchmark
6. Regulatory Knowledge Management 中的 RAG + 认知计算架构
- 来源: arXiv 2607.24352(2026-07-27)
- 核心: 本地 LLM(无高端 GPU)配合 RAG 支撑监管合规场景,分析能力持续运行
- 标签:
ragbenchmark
7. Evidence Attribution 视觉文档理解(无坐标版)
- 来源: HF Daily arXiv 2607.24651(2026-07-26)
- 核心: 评估幻觉归因中坐标接口的局限性;CiteVQA 双语验证集
- 标签:
benchmarkmultimodal
🔍 Substack 线索(1 条)
Designing Agentic Memory in 2026 — The Nuanced Perspective - 五大认知记忆类型分类及各自检索逻辑 - 记忆投毒攻击研究:>90% Agent 易感,修正后复发率 100% - 核心结论:存储/检索/更新/丢弃决策均属架构决策,不会默认做对 - URL: https://thenuancedperspective.substack.com/p/designing-agentic-memory-in-2026
本期小结
| 维度 | 数值 |
|---|---|
| 候选总数 | 7 |
| 高价值 | 3 |
| arXiv 来源 | 6 篇(全部 2026-07-27) |
| HF Daily 来源 | 2 篇 |
| Substack | 1 条 |
| CSDN | 未使用 |
Tom 文献雷达 · 轻量模式 · 2026-07-28 14:40 UTC