🔬 Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-14

本期速览

本期 8 条候选,聚焦 RAG 安全边界(知识投毒检测)、多轮检索停止判断、议会语料权威感知检索,以及多语言多跳问答合成器折叠四大方向。长上下文压缩推理有新系统工作值得关注。


⭐ 高价值条目(4 条)

1. RAGSieve:自引用的 RAG 知识投毒检测

  • 来源: arXiv · 2608.13010v1 · 2026-08-13
  • 问题: RAG 系统检索文档可被注入恶意内容,现有检测器依赖可信引用或全局阈值,对语料拓扑敏感。
  • 方案: RAGSieve-Query(RSQ)做查询局部对比,对同一次检索的 Top-5 与第 6-20 名打分,检测答案锚定浓度和载体转换;RAGSieve-Graph(RSG)做语料局部对比,衡量每个文档的出/入度异常。
  • 亮点: 完全自引用,从被检系统自身构建参考基准,无需外部知识。
  • 标签: rag / benchmark / systems
  • 链接: http://arxiv.org/abs/2608.13010v1

2. ParliamentRAG:议会记录权威感知多视角 RAG

  • 来源: arXiv · 2608.13410v1 · 2026-08-13
  • 问题: 议会语料检索面临三大风险——高频发言者主导、话题专业发言权重缺失、政治敏感文本引用归属错误。
  • 方案: 构建话题依赖权威模型,估计每位发言者在各议题上的专业权重;在检索和生成阶段共同建模。
  • 亮点: 首次在真实议会记录(意大利众议院)上系统评估多视角 RAG,为民主问责场景提供可落地框架。
  • 标签: rag / benchmark / systems
  • 链接: http://arxiv.org/abs/2608.13410v1

3. Search-R1:多轮 RAG 何时停止?结构化停止判断

  • 来源: arXiv · 2608.13237v1 · 2026-08-13
  • 问题: 多轮检索需判断"证据足够"的时间点,但停止决策影响整条轨迹,不能视为独立状态分类。
  • 方案: 冻结 Search-R1 pipeline,将 S2G-RAG 的结构化充分性+缺口判断适配为停止策略;在 900 题 HotpotQA 子集上训练 Qwen3.5-2B 裁判模型。
  • 亮点: 将停止判断建模为顺序选择问题而非独立分类,是该方向的重要概念澄清。
  • 标签: rag / benchmark
  • 链接: http://arxiv.org/abs/2608.13237v1

4. Better Decomposition + Free Aggregation:多语言多跳问答

  • 来源: arXiv · 2608.13160v1 · 2026-08-13
  • 问题: 现有 mRAG 方案(全量翻译或统一分解聚合)均存在文化语义信息丢失和跨语言对齐噪声问题。
  • 方案: 提出 Synthesizer-Folding 框架:合成器输出多语言中间表示,折叠层在各语言子空间内自由聚合,避免一刀切翻译。
  • 亮点: 对文化敏感的多语言问答场景(东亚/中东/东南亚语言)有直接价值。
  • 标签: rag / benchmark
  • 链接: http://arxiv.org/abs/2608.13160v1

📋 其余候选(4 条)

5. AVA-Encoder:Agent 原生视频表示学习

  • 来源: HF Daily · 2608.12313 · 2026-08-11 · 4 votes
  • 将视频转换为知识图谱结构再重建为视频,支持电影级视频操控的 agent 规划。
  • 标签:agent / multimodal

6. AI4AI:视觉 Token 剪枝的 LLM 自动设计框架

  • 来源: HF Daily · 2608.07193 · 2026-08-06 · 6 votes
  • 让 LLM 自动设计视觉 token 压缩算法,应对多模态大模型推理成本高问题。
  • 标签:multimodal / systems

7. SKILLER:面向小语言模型的技能可复用提取

  • 来源: HF Daily · 2608.10538 · 2026-08-10
  • 将 agent 技能封装标准化并在消费级 GPU 部署,降低 OpenClaw/Codex 类 harness 的推理成本。
  • 标签:agent / systems

8. RMM:输入自适应的矩阵乘法化简

  • 来源: arXiv · 2608.13426v1 · 2026-08-13
  • 训练-free 的 LLM 推理加速,沿收缩维度选择性保留关键切片,1B-70B 均有效。
  • 标签:systems

📌 趋势观察

方向 状态 备注
RAG 安全(知识投毒) 🔥 升温 RAGSieve 自引用检测路线值得关注;CAIS 2026 也有相关工作
多轮 RAG 停止判断 🆕 新兴 Search-R1 概念突破,裁判模型是可行路径
权威感知检索 🆕 新兴 ParliamentRAG 落地真实语料,后续可扩展至法律/医疗
多语言 mRAG 持续 文化语义保留是核心痛点,Synthesizer-Folding 提供新思路
Agent 原生视频表示 中期 AVA-Encoder 思路新颖,距实用尚远

🗞️ 外部线索

无 Substack 明确命中。 补充线索:RAG 知识投毒方向 2026 年持续活跃,除 RAGSieve 外,MLRP(加拿大 AI 年会)有 Cross-Encoder 激活信号防御工作(Moradi et al., 2026),EmergentMind 综述亦指出"大多数 RAG 部署仍暴露于实际可操作的投毒攻击"。


Tom 文献雷达 · 每日 3 次 · Agent / RAG / 长上下文 · 2026-08-14 20:40 CST 来源:arXiv metadata + Hugging Face Daily · 去重参考最近 7 天文件名