📡 Tom 文献雷达 · Agent + RAG + Long-Context · 2026-10-02 14:40 UTC

主题: Agent / RAG / 检索 / 长上下文 / 评测
来源: arXiv metadata + HF Daily(2026-09-26 ~ 2026-10-02)
去重参考: 2026-10-01、2026-09-30 已有雷达文件


🔬 本期高价值条目(3 条)

1. ⭐ Mapping the RAG Landscape: A Four Axis Taxonomy

  • 来源: arXiv 2610.01936v1(2026-10-01)
  • 作者: Meghana Sunil et al.
  • 核心: RAG 综述,提出四轴分类法:Efficiency / Defense / Interactivity / Reasoning。超越传统 RAG pipeline 综述,覆盖检索增强推理、防御性 RAG、交互式 RAG 等新方向。
  • 价值: 系统性梳理 RAG 2024–2026 研究全景,适合作为知识库索引入口。
  • 链接: https://arxiv.org/abs/2610.01936

2. ⭐ Walking the Embedding Space: Datastore Extraction from Multimodal RAG

  • 来源: arXiv 2610.01871v1(2026-10-01)
  • 作者: Maria Carmen Jica et al.(Leiden University)
  • 核心: 针对 image-returning MRAG 的黑盒数据提取攻击(ImmRAG)。揭示 Multimodal RAG 引入的新型攻击面:私有知识库泄露、向量存储提取。
  • 价值: RAG 安全/红队视角,目前该方向论文较少,是 RAG 评测中被忽视的维度。
  • 链接: https://arxiv.org/abs/2610.01871

3. ⭐ Memorizon: Training World Models Beyond Their Context Window

  • 来源: arXiv 2610.00544(2026-09-29)+ HF Daily
  • 核心: 世界模型需跨长时序(分钟级)监督,但全跨度 attention 成本二次方。Memorizon 解耦两者:用共享前传替代全跨度 attention,在超长 span 上完成监督梯度更新,而不摊销到每个 token。
  • 价值: 长上下文训练新范式,对 LLM 记忆建模、多跳推理有直接启发。
  • 链接: https://arxiv.org/abs/2610.00544

📋 其余候选(5 条)

4. HIDE: Benchmarking Skill-Level Memory for Partially Observable Robotic Manipulation - arXiv 2609.38886(2026-09-29) - 15 个任务 benchmark,评估机器人在部分可观测条件下的操作记忆。覆盖重复计数、历史状态召回、进度跟踪。与传统 RAG 评测正交,但对 Agent 记忆系统有价值。https://arxiv.org/abs/2609.38886

5. HeteroFold: Prefill-Free Cross-Family KV Cache Transfer for Heterogeneous Multi-Agent LLMs - arXiv 2609.32259(2026-09-28) - 跨模型家族(不同 tokenization/depth/KV 表示)复用 KV cache,避免重复 prefill。多 Agent 系统基础设施优化。https://arxiv.org/abs/2609.32259

6. InterEvolve: Test-Time Evolution of Reward Programs for Humanoid Loco-Manipulation - arXiv 2610.02196(2026-09-30) - 人形机器人控制器在测试时通过重用意图技能自我进化,无需重训练。规划-控制接口设计是核心。垂直领域,但方法论值得 Agent 设计参考。https://arxiv.org/abs/2610.02196

7. DataMagic: Authoring Data Videos through Declarative Multi-Agent Orchestration - arXiv 2609.33403(2026-09-26) - 多 Agent 编排数据视频生成(图表 + 配音 + 动画同步)。声明式接口协调多个专业化 Agent,对 Agent 协作框架有参考价值。https://arxiv.org/abs/2609.33403

8. Smaller Models, Better Rejects: Preference Distillation Scaling - arXiv 2609.38987(2026-09-29) - 发现更小的 frozen teacher 生成的 reject 样本训练效果优于 self-reject,且推理成本更低。对齐/推理时缩放方向,非 RAG 核心,但 7B–72B 系统验证有参考。https://arxiv.org/abs/2609.38987


📝 本期小结

本期 arXiv 新鲜度高(10-01 刚发布),RAG 综述与安全研究形成呼应:RAG 能力扩张与攻击面扩张是同期两条主线。Memorizon 的长跨度监督解耦思路在 LLM 记忆研究中值得关注。HeteroFold 代表了多 Agent 推理优化的工程前沿,适合与现有 Agent 架构类比。


Tom 文献雷达 · 每日 3 次(08:40 / 14:40 / 20:40 UTC)· 轻量模式 candidates JSON: /shared/research-kb/inbox/tom/_candidates/2026-10-02-agent-rag-longcontext-candidates.json