Tom 文献雷达 · AI Agent × RAG × 长上下文 · 2026-10-08

概览

  • 主题:agent-rag-longcontext
  • 来源:arXiv + Hugging Face Daily
  • 候选总数:8 条
  • 高价值:4 条
  • Substack:1 条(AlphaSignal)
  • CSDN:无

★ 高价值条目(4 条)

1. UNREAL: Unifying Retrieval and Long-Context with a Single Model

  • 来源:arXiv (2610.08463v1)
  • 作者:Edan Kinderman et al.
  • 核心:提出 UNREAL,用模型内部表征直接统一 RAG 和长上下文两种证据选择机制。仅加 <500K 可训练参数,在 3B-token、21M-chunk 的 Wikipedia 数据集上验证,骨干网络完全冻结。
  • 标签:rag · long-context · benchmark · systems
  • 价值点:端到端统一检索与上下文,改变了"短窗口用 RAG、长窗口用 Full-seq"的二分格局;参数量极低,适合在产线轻量集成。
  • 链接:http://arxiv.org/abs/2610.08463v1

2. EC-RAG: Event链 Retrieval-Augmented Generation for 长视频理解

  • 来源:arXiv (2610.08674v1)
  • 作者:Yuhao Qin, Junbo Wang, Yuke Li, Yining Zhu
  • 核心:EC-RAG 将长视频内容建模为显式事件链(Event Chain),在此基础上做 QA 推理。训练无关(training-free),解决现有方法以帧/片段为单位、无法建模跨事件时序依赖的问题。
  • 标签:rag · benchmark · multimodal
  • 价值点:视频 Agent 的记忆层新范式;事件链提供了可解释的检索结构;适合作为视频 Agent 的上下文组织模块参考。
  • 链接:http://arxiv.org/abs/2610.08674v1

3. RAG-PIBench: RAG 提示词注入检测基准

  • 来源:arXiv (2610.08571v1)
  • 作者:Niveen O. Jaffal, Ahmet Yuksel, David Mohaisen
  • 核心:首个面向 RAG 场景的提示词注入检测基准(RAG-PIBench),含 4,876 条样本,分 frozen-train / val / protected-test 三档。DistilBERT 达 F1=0.896、PR-AUC=0.968;TF-IDF+SVM 仍有竞争力。
  • 标签:rag · benchmark · systems
  • 价值点:RAG 安全评测绕不开的基准;揭示了 RAG 管道中"检索内容不可信"的系统性风险;多 Detector 对比有工程参考价值。
  • 链接:http://arxiv.org/abs/2610.08571v1

4. δ-mem: RAG 与 Long Context 之外的 Agent 记忆第三条路

  • 来源:Substack · AlphaSignal(2026-05-12 arXiv 论文策展)
  • 核心:δ-mem 提出用微型关联记忆矩阵(8×8)替代向量数据库或扩展上下文;在 Qwen3-4B-Instruct 上,仅 4.87M 可训练参数(0.12% 模型参数)即可将 5 个 benchmark 平均提升约 5%。
  • 标签:agent · memory
  • 价值点:论文原文 2026-05-12,距今约 5 个月,仍未被高频引述;"第三条路"叙事清晰,适合作为 Agent 记忆层选型时的对比 baseline。已在 Hugging Face 开源(CC-BY-4.0)。
  • 链接:https://alphasignalai.substack.com/p/rag-and-long-context-arent-enough

其余候选(4 条)

# 标题 来源 标签 备注
5 Structuring MoE Expert Selection for Agentic RL arXiv 2610.07332 agent · MoE 发现 Agent 操作类型(READ/UPDATE)与 MoE 路由结构自然对齐;RL 算法未利用此结构
6 DeCoPrune: KV-Cache Pruning via Denoising Consistency arXiv 2609.39096 multimodal 自回归视频扩散的 KV-Cache 压缩;去噪一致性作为 token 保留 proxy
7 DMAD: Distribution Matching as Adversarial Distillation arXiv 2610.02188 memory DMD 的替代方案,无需辅助扩散模型拟合学生分布
8 Sensor-Language-Action Models arXiv 2610.08244 multimodal 传感器→语言→动作统一建模;语言作为语义桥接层

本轮去重参考

  • 2026-10-07 已有同题 radar,无重复条目。
  • δ-mem 来自 Substack 补充(2026-05-12 论文),前轮未收录。

Tom 文献雷达 · 轻量版 · 2026-10-08 · 08:40 UTC