Tom 文献雷达 · Agent + RAG + Long Context · 2026-08-01 14:40 CST

本期概况

  • 候选总数:8 条
  • 高价值:4 条
  • 数据来源:arXiv metadata + HF Daily(2026-07-27 ~ 07-30)
  • Substack 补充:无(轻量模式未触发)
  • 说明:第三次日报运行,内容基于当日第二批 arXiv/HF Daily candidates

⭐ 高价值条目(4 条)

1. DualG-MRAG: Decoupling Macro-Reasoning and Micro-Matching for Multimodal RAG

  • 来源:arXiv · 2026-07-30
  • 作者:Jiacheng Tao, Qingyun Sun, Haonan Yuan, Ziwei Zhang, Jianxin Li
  • 链接:http://arxiv.org/abs/2607.28580v1
  • 标签:RAG · multimodal · benchmark
  • 摘要:现有 MM-RAG 方法在复杂多跳推理任务上表现不佳,核心问题是实例级独立匹配无法捕获跨模态/跨文档显式关系。现有图增强方法面临两难:细粒度视觉特征导致图快速膨胀和检索噪声;粗粒度表示则丢弃关键局部证据。DualG-MRAG 将宏推理与微匹配解耦处理。
  • 价值判断:多跳 multimodal RAG 的架构级改进,值得跟进。

2. GLM-RAG: Graph Language Models for Graph-Based RAG

  • 来源:arXiv · 2026-07-30
  • 作者:Maya Arseven, Anette Frank, Beni Egressy, Johann Higl, Moritz Plenz
  • 链接:http://arxiv.org/abs/2607.28397v1
  • 标签:RAG · benchmark
  • 摘要:RAG over knowledge graph 需要同时捕获图结构和语义信息。本文引入 GLM(Graph Language Model)作为 retriever,与 GNN-based、vector-search-based retriever 在单跳和多跳 RAG 场景下做系统对比评估。
  • 价值判断:GLM vs GNN vs 向量检索在知识图谱 RAG 上的系统性对比,评测设计有价值。

3. Σ-Mem: Online Reliability Memory for Multi-Agent Systems

  • 来源:HF Daily · 2026-07-29
  • 链接:https://arxiv.org/abs/2607.27958
  • 标签:agent · memory · systems
  • 摘要:现有 memory 系统主要保存交互内容,而非建模哪些 agent 在何种条件下可被信任。Σ-Mem 提出在线可靠性记忆,通过后决策正确性反馈实时更新对等方 competence 证据和对等关系证据,解决中心模型无法直接验证对等响应的核心问题。
  • 价值判断:multi-agent 信任建模与 memory 交叉的前沿工作,思路新颖。

4. Filesystem-Based Memory for LLM Agents: Organization, Evolution, and Sustainability

  • 来源:HF Daily · 2026-07-28
  • 链接:https://arxiv.org/abs/2607.26637
  • 标签:agent · RAG · memory · benchmark
  • 摘要:首个对 LLM agent 文件系统式长期记忆的系统性研究。核心问题:agent 能否在记忆累积、冲突、过时时保持目录树组织结构?这种组织方式是否值得?提出 benchmark 框架。
  • 价值判断:将"markdown 文件树"作为 agent memory 媒介的首个系统研究,贴近工程实际。

📋 其他候选(4 条)

5. ConMem: Contribution-Aware Memory for Manufacturing Inspection Logs

  • 来源:arXiv · 2026-07-30 · 标签:RAG · memory · systems
  • 摘要:工业检查长周期 memory 框架,通过 contribution scoring 筛选高诊断价值证据单元,实现早期风险预警。为 memory 的"贡献感知"提供工程落地路径。

6. See2Think: Do Multimodal Models Use Intermediate Visual States?

  • 来源:HF Daily · 2026-07-28 · 标签:multimodal · benchmark
  • 摘要:See2Think benchmark(含 VAoT),1200 个开放视觉依赖问题,评估多模态 LLM 是否真正依赖中间视觉状态。适合诊断 multimodal pipeline 中的 reasoning 链路。

7. OmniScope: Modality-Decoupled Token Compression

  • 来源:HF Daily · 2026-07-27 · 标签:multimodal
  • 摘要:训练无关的 token 压缩框架,对 audio/video 分别估算 query 相关性,解决跨模态显著性不匹配问题,减少多模态 LLM 推理 token 预算。

8. Fairness Pruning: Demographic Bias in GLU-MLP Layers

  • 来源:HF Daily · 2026-07-29 · 标签:systems
  • 摘要:通过对比激活分析定位 LLM 中的人口统计学偏置神经元,与本 radar 主题关联度较低。

💡 本期洞察

RAG + Agent + Memory 三条主线趋同: 1. 多跳 RAG 的图解耦:DualG-MRAG 和 GLM-RAG 分别从推理结构和 retriever 架构层面改进了多跳场景,是近期 RAG 领域的主要创新方向。 2. Agent Memory 的可信赖性:Σ-Mem 引入在线信任评估,Filesystem Memory 探索持久化组织,共同指向 memory 不只是"记住"而是"可信地记住"。 3. 多模态 RAG 的 token 效率:OmniScope 和 See2Think 分别从压缩和诊断角度补全了 multimodal RAG pipeline 的工程视角。


Tom 文献雷达 · 每日 3 次 · 轻量版 生成时间:2026-08-01T06:40 UTC(第三轮)