Tom 文献雷达 · Agent + RAG + 长上下文 · 2026-10-02 晚场

概览

  • 候选总数:8 条
  • 高价值:4 条(⭐)
  • 来源:arXiv(2)+ Hugging Face Daily(6)
  • Substack 参考:1 条
  • CSDN:未使用

⭐ 高价值候选

1. Mapping the RAG Landscape: A Four Axis Taxonomy ⭐

  • 来源: arXiv,2026-10-01
  • 作者: Meghana Sunil et al.
  • 摘要: 对 RAG 领域进行四轴分类(效率 / 防御 / 交互性 / 推理),梳理了超越基础 RAG 管线的最新研究方向。
  • 标签: rag benchmark
  • 价值: 综合调研,利于体系化理解 RAG 当前演进全貌。

2. Walking the Embedding Space: Datastore Extraction from Multimodal RAG ⭐

  • 来源: arXiv,2026-10-01
  • 作者: Maria Carmen Jica et al.
  • 摘要: 针对返回图像的 MRAG 系统提出黑盒数据提取攻击程序 \immrag,揭示多模态 RAG 新的攻击面(隐私泄露风险)。
  • 标签: rag benchmark multimodal
  • 价值: RAG 安全/防御维度,与高价值 1 形成互补。

3. When Does Correction Become Repair? Mechanistic Auditing of Tool-Using LLMs ⭐

  • 来源: arXiv,2026-09-27
  • 摘要: 提出 SAKIKO 审计框架,系统性评估对 Agent 工具调用前内部激活干预的效果与副作用,覆盖 7 个 LLM。
  • 标签: agent
  • 价值: Agent 可观测性与内省机制,排障经验可迁移。

4. JevSpawn: Adaptive Agentic Inference through Compositional Action Spaces ⭐

  • 来源: arXiv,2026-09-29
  • 摘要: 将自然语言任务规范连接到有限概率探索空间的组合策略,并行动作生成 + 反馈驱动分支选择,替代逐 token 自回归。
  • 标签: agent systems
  • 价值: Agent 推理效率新范式,减少长程交互计算成本。

其他候选

5. PhysVista: Benchmarking Physical Intelligence in VLMs

  • HF Daily,2026-09-29,votes 7
  • 感知-推理-评估闭环的 VLM 物理智能基准,多模态 RAG 场景可参考其评测设计。
  • 标签:rag benchmark multimodal

6. LOCI: Spatial Linear Memory for Streaming World Models

  • HF Daily,2026-09-30,votes 3
  • 混合 key-value 缓存 + 紧凑循环记忆,解决视频世界模型中记忆与检索的权衡。
  • 标签:memory multimodal

7. Architect-Ant: Editable Automatic Furnishing of Floor Plans

  • HF Daily,2026-09-29,votes 5
  • 约束感知布局生成,室内设计 Agent 工作流参考。
  • 标签:agent systems

8. Generalization Is Stability, Not Accuracy

  • HF Daily,2026-09-30,votes 4
  • 关注 LLM 泛化稳定性而非单一准确率,对 RAG 检索一致性评估有参考价值。
  • 标签:benchmark

Substack 参考

Please Stop Saying Long Context Windows Will Replace RAG — Cobus Greyling,2026 年。核心论点:128K–1M token 上下文是战略优势而非 RAG 的替代品;成熟团队走混合路线,按查询特征路由到合适策略。


趋势小结

维度 热点信号
RAG 分类 四轴Taxonomy(效率/防御/交互/推理)正在形成共识
RAG 安全 MRAG 数据提取攻击成为新攻击面
Agent 内省 机制化审计(SAKIKO)开始量化内部干预效果
Agent 效率 组合动作空间 + 并行生成替代自回归是前沿方向
长上下文 混合路由(long context + selective retrieval)成主流范式

Generated by Tom · 2026-10-02T20:40 CST · candidates JSON: /shared/research-kb/inbox/tom/_candidates/2026-10-02-agent-rag-longcontext-candidates.json