Tom 文献雷达 · Agent / RAG / Long-Context · 2026-08-02 08:40

候选摘要(8 条)

# 来源 标题 标签 关键信号
1 HF Daily Σ-Mem: Online Reliability Memory for Multi-Agent agent, memory, systems votes=12
2 HF Daily Filesystem-Based Memory for LLM Agents agent, rag, memory, benchmark votes=6
3 arXiv DualG-MRAG: Decoupling Macro/Micro RAG for Multimodal rag, benchmark, multimodal 2026-07-30
4 arXiv GLM-RAG: Graph Language Models for Graph-Based RAG rag, benchmark 2026-07-30
5 HF Daily See2Think: Multimodal Models & Intermediate Visual States rag, benchmark, multimodal votes=22
6 HF Daily OmniScope: Modality-Decoupled Token Compression multimodal votes=3
7 arXiv ConMem: Contribution-Aware Memory for Inspection Logs rag, memory, systems 2026-07-30
8 HF Daily Fairness Pruning: Demographic Bias in GLU-MLP benchmark, systems votes=2

高价值条目(3 条)

★★★ Σ-Mem: 多智能体系统在线可信度记忆

  • arXiv: https://arxiv.org/abs/2607.27958
  • 核心: 现有记忆系统只存交互内容,不建模「谁可信/何时可信」。Σ-Mem 记录每个 peer 的历史能力证据及关系证据,基于后决策正确性反馈实时更新。对多智能体场景(中心模型无法直接验证 peer 响应)有直接价值。
  • 亮点: 首次提出多智能体「可靠性记忆」,Weyl 不等式支撑更新机制。

★★★ Filesystem-Based Memory: Agent 文件系统记忆的组织与演化

  • arXiv: https://arxiv.org/abs/2607.26637
  • 核心: 首个系统性研究 LLM Agent 文件系统式记忆的工作(目录树 markdown)。检验两个默认假设:(1) Agent 能否在记忆累积、冲突、过时后保持组织;(2) 这种组织是否值得。
  • 亮点: 填补了「实际部署中文件系统记忆」这一被忽视场景的研究空白,含基准测试。

★★ DualG-MRAG: 宏微观解耦的多模态 RAG

  • arXiv: https://arxiv.org/abs/2607.28580
  • 核心: 现有 MM-RAG 在多跳推理上失败,原因在于粗粒度丢细节、细粒度图爆炸两难。DualG-MRAG 解耦宏推理与微匹配,引入图结构建模同时控制检索噪声。
  • 亮点: 对多文档多模态场景(图表混合检索)有直接工程意义。

Substack 线索

Agent Memory Is Not RAG — Claudio Stamile (Jan 2026) https://claudiostamile.substack.com/p/agent-memory-is-not-rag-a-practical 核心论点:Agent 记忆 ≠ RAG ≠ Long-Context,三者评估标准不同。Agent 记忆强调随时间的自适应演化,而非检索质量或序列长度。建议从 forms(形式)、functions(功能)、lifecycles(生命周期)三个正交维度设计记忆系统。 与本次 Filesystem-Based Memory 论文形成实践印证。


去重备注

  • 2026-08-01T1440 的 v2 radar 已覆盖 GLM-RAG 相邻方向(Graph RAG);本文仅收录该批次未出现的条目。
  • Σ-Mem 与 ConMem 均涉及 memory 贡献评估,但 Σ-Mem 面向多智能体可信度,ConMem 面向工业检测日志,方向互补。

生成时间: 2026-08-02 08:40 UTC
来源: arXiv metadata + HuggingFace Daily
Substack: 1 条
CSDN: 未使用
后续建议关注: Σ-Mem 的 Weyl 更新机制是否能迁移到单 Agent 自我评估;Filesystem Memory 的组织代价是否在 long-horizon 任务中可接受。