Tom 文献雷达 · AI Agent × RAG × 长上下文 · 2026-10-08
概览
- 主题:agent-rag-longcontext
- 来源:arXiv + Hugging Face Daily
- 候选总数:8 条
- 高价值:4 条
- Substack:1 条(AlphaSignal)
- CSDN:无
★ 高价值条目(4 条)
1. UNREAL: Unifying Retrieval and Long-Context with a Single Model
- 来源:arXiv (2610.08463v1)
- 作者:Edan Kinderman et al.
- 核心:提出 UNREAL,用模型内部表征直接统一 RAG 和长上下文两种证据选择机制。仅加 <500K 可训练参数,在 3B-token、21M-chunk 的 Wikipedia 数据集上验证,骨干网络完全冻结。
- 标签:rag · long-context · benchmark · systems
- 价值点:端到端统一检索与上下文,改变了"短窗口用 RAG、长窗口用 Full-seq"的二分格局;参数量极低,适合在产线轻量集成。
- 链接:http://arxiv.org/abs/2610.08463v1
2. EC-RAG: Event链 Retrieval-Augmented Generation for 长视频理解
- 来源:arXiv (2610.08674v1)
- 作者:Yuhao Qin, Junbo Wang, Yuke Li, Yining Zhu
- 核心:EC-RAG 将长视频内容建模为显式事件链(Event Chain),在此基础上做 QA 推理。训练无关(training-free),解决现有方法以帧/片段为单位、无法建模跨事件时序依赖的问题。
- 标签:rag · benchmark · multimodal
- 价值点:视频 Agent 的记忆层新范式;事件链提供了可解释的检索结构;适合作为视频 Agent 的上下文组织模块参考。
- 链接:http://arxiv.org/abs/2610.08674v1
3. RAG-PIBench: RAG 提示词注入检测基准
- 来源:arXiv (2610.08571v1)
- 作者:Niveen O. Jaffal, Ahmet Yuksel, David Mohaisen
- 核心:首个面向 RAG 场景的提示词注入检测基准(RAG-PIBench),含 4,876 条样本,分 frozen-train / val / protected-test 三档。DistilBERT 达 F1=0.896、PR-AUC=0.968;TF-IDF+SVM 仍有竞争力。
- 标签:rag · benchmark · systems
- 价值点:RAG 安全评测绕不开的基准;揭示了 RAG 管道中"检索内容不可信"的系统性风险;多 Detector 对比有工程参考价值。
- 链接:http://arxiv.org/abs/2610.08571v1
4. δ-mem: RAG 与 Long Context 之外的 Agent 记忆第三条路
- 来源:Substack · AlphaSignal(2026-05-12 arXiv 论文策展)
- 核心:δ-mem 提出用微型关联记忆矩阵(8×8)替代向量数据库或扩展上下文;在 Qwen3-4B-Instruct 上,仅 4.87M 可训练参数(0.12% 模型参数)即可将 5 个 benchmark 平均提升约 5%。
- 标签:agent · memory
- 价值点:论文原文 2026-05-12,距今约 5 个月,仍未被高频引述;"第三条路"叙事清晰,适合作为 Agent 记忆层选型时的对比 baseline。已在 Hugging Face 开源(CC-BY-4.0)。
- 链接:https://alphasignalai.substack.com/p/rag-and-long-context-arent-enough
其余候选(4 条)
| # | 标题 | 来源 | 标签 | 备注 |
|---|---|---|---|---|
| 5 | Structuring MoE Expert Selection for Agentic RL | arXiv 2610.07332 | agent · MoE | 发现 Agent 操作类型(READ/UPDATE)与 MoE 路由结构自然对齐;RL 算法未利用此结构 |
| 6 | DeCoPrune: KV-Cache Pruning via Denoising Consistency | arXiv 2609.39096 | multimodal | 自回归视频扩散的 KV-Cache 压缩;去噪一致性作为 token 保留 proxy |
| 7 | DMAD: Distribution Matching as Adversarial Distillation | arXiv 2610.02188 | memory | DMD 的替代方案,无需辅助扩散模型拟合学生分布 |
| 8 | Sensor-Language-Action Models | arXiv 2610.08244 | multimodal | 传感器→语言→动作统一建模;语言作为语义桥接层 |
本轮去重参考
- 2026-10-07 已有同题 radar,无重复条目。
- δ-mem 来自 Substack 补充(2026-05-12 论文),前轮未收录。
Tom 文献雷达 · 轻量版 · 2026-10-08 · 08:40 UTC