🔬 Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-14
本期速览
本期 8 条候选,聚焦 RAG 安全边界(知识投毒检测)、多轮检索停止判断、议会语料权威感知检索,以及多语言多跳问答合成器折叠四大方向。长上下文压缩推理有新系统工作值得关注。
⭐ 高价值条目(4 条)
1. RAGSieve:自引用的 RAG 知识投毒检测
- 来源: arXiv ·
2608.13010v1· 2026-08-13 - 问题: RAG 系统检索文档可被注入恶意内容,现有检测器依赖可信引用或全局阈值,对语料拓扑敏感。
- 方案: RAGSieve-Query(RSQ)做查询局部对比,对同一次检索的 Top-5 与第 6-20 名打分,检测答案锚定浓度和载体转换;RAGSieve-Graph(RSG)做语料局部对比,衡量每个文档的出/入度异常。
- 亮点: 完全自引用,从被检系统自身构建参考基准,无需外部知识。
- 标签: rag / benchmark / systems
- 链接: http://arxiv.org/abs/2608.13010v1
2. ParliamentRAG:议会记录权威感知多视角 RAG
- 来源: arXiv ·
2608.13410v1· 2026-08-13 - 问题: 议会语料检索面临三大风险——高频发言者主导、话题专业发言权重缺失、政治敏感文本引用归属错误。
- 方案: 构建话题依赖权威模型,估计每位发言者在各议题上的专业权重;在检索和生成阶段共同建模。
- 亮点: 首次在真实议会记录(意大利众议院)上系统评估多视角 RAG,为民主问责场景提供可落地框架。
- 标签: rag / benchmark / systems
- 链接: http://arxiv.org/abs/2608.13410v1
3. Search-R1:多轮 RAG 何时停止?结构化停止判断
- 来源: arXiv ·
2608.13237v1· 2026-08-13 - 问题: 多轮检索需判断"证据足够"的时间点,但停止决策影响整条轨迹,不能视为独立状态分类。
- 方案: 冻结 Search-R1 pipeline,将 S2G-RAG 的结构化充分性+缺口判断适配为停止策略;在 900 题 HotpotQA 子集上训练 Qwen3.5-2B 裁判模型。
- 亮点: 将停止判断建模为顺序选择问题而非独立分类,是该方向的重要概念澄清。
- 标签: rag / benchmark
- 链接: http://arxiv.org/abs/2608.13237v1
4. Better Decomposition + Free Aggregation:多语言多跳问答
- 来源: arXiv ·
2608.13160v1· 2026-08-13 - 问题: 现有 mRAG 方案(全量翻译或统一分解聚合)均存在文化语义信息丢失和跨语言对齐噪声问题。
- 方案: 提出 Synthesizer-Folding 框架:合成器输出多语言中间表示,折叠层在各语言子空间内自由聚合,避免一刀切翻译。
- 亮点: 对文化敏感的多语言问答场景(东亚/中东/东南亚语言)有直接价值。
- 标签: rag / benchmark
- 链接: http://arxiv.org/abs/2608.13160v1
📋 其余候选(4 条)
5. AVA-Encoder:Agent 原生视频表示学习
- 来源: HF Daily ·
2608.12313· 2026-08-11 · 4 votes - 将视频转换为知识图谱结构再重建为视频,支持电影级视频操控的 agent 规划。
- 标签:agent / multimodal
6. AI4AI:视觉 Token 剪枝的 LLM 自动设计框架
- 来源: HF Daily ·
2608.07193· 2026-08-06 · 6 votes - 让 LLM 自动设计视觉 token 压缩算法,应对多模态大模型推理成本高问题。
- 标签:multimodal / systems
7. SKILLER:面向小语言模型的技能可复用提取
- 来源: HF Daily ·
2608.10538· 2026-08-10 - 将 agent 技能封装标准化并在消费级 GPU 部署,降低 OpenClaw/Codex 类 harness 的推理成本。
- 标签:agent / systems
8. RMM:输入自适应的矩阵乘法化简
- 来源: arXiv ·
2608.13426v1· 2026-08-13 - 训练-free 的 LLM 推理加速,沿收缩维度选择性保留关键切片,1B-70B 均有效。
- 标签:systems
📌 趋势观察
| 方向 | 状态 | 备注 |
|---|---|---|
| RAG 安全(知识投毒) | 🔥 升温 | RAGSieve 自引用检测路线值得关注;CAIS 2026 也有相关工作 |
| 多轮 RAG 停止判断 | 🆕 新兴 | Search-R1 概念突破,裁判模型是可行路径 |
| 权威感知检索 | 🆕 新兴 | ParliamentRAG 落地真实语料,后续可扩展至法律/医疗 |
| 多语言 mRAG | 持续 | 文化语义保留是核心痛点,Synthesizer-Folding 提供新思路 |
| Agent 原生视频表示 | 中期 | AVA-Encoder 思路新颖,距实用尚远 |
🗞️ 外部线索
无 Substack 明确命中。 补充线索:RAG 知识投毒方向 2026 年持续活跃,除 RAGSieve 外,MLRP(加拿大 AI 年会)有 Cross-Encoder 激活信号防御工作(Moradi et al., 2026),EmergentMind 综述亦指出"大多数 RAG 部署仍暴露于实际可操作的投毒攻击"。
Tom 文献雷达 · 每日 3 次 · Agent / RAG / 长上下文 · 2026-08-14 20:40 CST 来源:arXiv metadata + Hugging Face Daily · 去重参考最近 7 天文件名