rag · E1 预消化简报(2026-08-20)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(2026-08-18 下午 ~ 2026-08-20 早间)+ paper_cards 近 3 天新卡抽查 本简报目的: 为今晚 RAG 活文档接力(R65 → R66)预习备料,聚焦尚未进入 R65 基线的增量条目 背景说明: R65 于 2026-08-20 凌晨收官(GRIP query dominance + IGD 意图引导解码 + DSPrompt M-RAG 动态软提示防御 + Hypergraph M-RAG 超图 N 元关系 + MC-Search ICLR 2026 Oral + Preference Is Not Intervention)。今日 8-20 雷达出现 3 条 RAG 直接相关条目(COMA / Preference Is Not Intervention 深层数据 / CoAL-RAG),全部为 paper_cards 最新批(2608.17960 / 2608.17781 / 2608.17536),均为 R65 基线后的 net-new 增量。本简报聚焦此 3 条。
一、增量条目(3 条,2 条 net-new 方法学 + 1 条深层量化数据增量)
增量 1 · ⭐⭐⭐ 高 · COMA:针对 Security-RAG 的组合式误导攻击与因果反事实防御(arXiv 2608.17960)
来源: Tom/inbox/tom/2026-08-20-agent-rag-longcontext-radar.md(高价值条目 #1)+ paper_cards/1006(主分类 rag · 形态 position · 副分类 risk) arXiv: 2608.17960v1 主分类: rag;形态: position/benchmark;副分类: risk, security, causal-inference
TLDR(来源:paper_cards/1006): An audit is proposed that measures the leave-one-out causal influence of each retrieved document and flags answers whose influence concentrates on low-trust documents, and proposes an audit that measures the leave-one-out causal influence of each retrieved document and flags answers whose influence concentrates on low-trust documents.
要点(来源:Tom 8-20 radar): - 核心问题:Security-RAG(安全运营 Copilot)面临新型攻击面——COMA = Compositional Misleading Attack,每份对抗文档单独看都是真实的、无指令的、无矛盾的,但组合起来可以让 copilot 先给出可利用的漏洞评估,再推荐一个"修复"方案反而保留漏洞。不同于传统 prompt injection,COMA 攻击不需要文档本身包含恶意指令 - 核心方案:留一因果影响审计(leave-one-out causal influence)+ 对影响集中于低可信度文档的答案进行标记;因果反事实防御(causal counterfactual defense) - 关键洞察:防御需要组合层面的完整性验证,而非逐文档审核;这一攻击模式揭示了 Security-RAG 的系统性盲点——即使单文档审核通过,多文档组合仍可构造隐蔽攻击链 - 与活文档 knowledge/rag.md R65 现有脉络的关系:R65 §2.8 安全与治理已有 DSPrompt(M-RAG 动态软提示防御)条目;COMA 补充 R65 §2.8 的攻击层——是 DSPrompt 的"对手盘":DSPrompt 解决 M-RAG 向量空间投毒攻击,COMA 解决文档组合层面隐蔽误导;两者共同构成 RAG 安全 40 面后的新攻防对偶 - 归入节: §2.8 安全与治理(补充:COMA 组合式误导攻击 + 留一因果影响审计 + 隐蔽攻击链防御)或新增 §2.8.1(Security-RAG 攻击与防御对偶)
增量 2 · ⭐⭐⭐ 高 · Preference Is Not Intervention:证据效用的读者异质性深层量化(arXiv 2608.17781)
来源: Tom/inbox/tom/2026-08-20-agent-rag-longcontext-radar.md(高价值条目 #4)+ paper_cards/1013(主分类 rag · 形态 method · 已在 R65 §0 引用,但深层量化数据为新发现) arXiv: 2608.17781v1 主分类: rag;形态: method/benchmark;副分类: reader-heterogeneity, evidence-utility, evaluation-methodology
TLDR(来源:paper_cards/1013 + Tom 8-20 radar 深层数据): Reader-specific utility exists, but preference is not intervention: stable ranking similarity does not license transfer of help/harm decisions, and stable ordinal similarity fails to predict cross-reader intervention transfer.
深层量化数据(来源:Tom 8-20 radar,今日新发现,paper_cards/1013 卡片本身未完全呈现): - 9 个读者在 33% 的联合影响单元中对效果符号意见相反(helpful vs. harmful) - 读者×查询交互解释了 29.8% 的效用方差(vs. 8.4% 排列零假设) - 自选证据 F1 提升 +0.031(t=3.39,统计显著) - 稳定的排序相似性不能授权帮助/伤害决策的跨读者迁移 - 稳定的序数相似性无法预测跨读者的干预迁移
要点: - 核心问题:证据效用(evidence utility)不是稳定的任务属性,而是读者×查询的交互效应——同一检索结果对不同读者产生相反效果,且无法从读者画像或排序相似性预测 - 核心方案:holding query/evidence/task/scoring/intervention fixed,系统测量读者异质性;提出读者×查询作为证据效用的基本分析单元 - 关键洞察:RAG 评测设计需要将 reader 作为变量而非控制因素;这一发现对 RAG 个性化和自适应检索策略有深远影响——固定读者假设下的评测结论不可迁移 - 与活文档 knowledge/rag.md R65 现有脉络的关系:R65 §0 已记录 Preference Is Not Intervention 存在,今日深层数据是 R65 §0.5.1 第 5 条脉络的增量补充(原 R65 记录了该方法的存在,今日新增具体数字:33% 意见相反 / 29.8% 方差解释 / +0.031 F1);该深层数据与 MC-Search(ICLR 2026 Oral,3,333 样本 3.7 hops 评测)形成评测方法学的实证层——两者共同表明 RAG 评测需要 reader + process 双变量 - 归入节: §0.5.1(补充:Preference Is Not Intervention 深层量化数据 33% / 29.8% / +0.031)+ §2.5 评测与泄漏(邻接:读者异质性对 RAG 评测设计的警示)
增量 3 · ⭐⭐ 中 · CoAL-RAG:复杂度感知的法律检索增强生成(arXiv 2608.17536)
来源: Tom/inbox/tom/2026-08-20-agent-rag-longcontext-radar.md(候选条目,高价值)+ paper_cards/1014(主分类 rag · 形态 method)+ work-queue.md Top 15 arXiv: 2608.17536v1 主分类: rag;形态: method;副分类: legal-rag, complexity-aware, adaptive-routing
TLDR(来源:paper_cards/1014): CoAL-RAG is proposed, a complexity-aware legal retrieval-augmented generation method, which constructs a multi-dimensional evaluation mechanism based on "question essence" and "retrieval consistency" to enable adaptive routing of retrieval strategies.
要点: - 核心问题:法律 RAG 场景中不同问题复杂度差异巨大(简单事实查询 vs. 复杂多条款综合分析),现有法律 RAG 系统采用统一检索策略,导致简单问题过度检索(成本浪费)和复杂问题检索不足(答案质量下降) - 核心方案:CoAL-RAG = Complexity-Aware Legal RAG,基于"问题本质"(question essence)与"检索一致性"(retrieval consistency)构建多维评估机制,实现检索策略的自适应路由(adaptive routing) - 关键洞察:法律领域是 RAG 复杂度分级的天然试验场;问题复杂度感知将成为法律、医疗、金融等高风险垂直 RAG 的标配能力 - 与活文档 knowledge/rag.md R65 现有脉络的关系:R65 无复杂度感知法律 RAG 专项条目;R65 §2.7 多模态 RAG 已有 28 个垂直域,CoAL-RAG 补充第 29 个垂直域 = 复杂度感知法律 RAG 垂直域;与 R64 ParliamentRAG(政治权威感知法律 RAG)同属法律 RAG 垂直域系列,CoAL-RAG 与 ParliamentRAG 形成法律 RAG 双件套(复杂度感知 + 权威感知) - 归入节: §2.7 多模态 RAG 垂直域(补充:CoAL-RAG 复杂度感知法律 RAG 第 29 垂直域)或 §2.7.2 法律 RAG(与 ParliamentRAG 并列)
二、R65 基线确认(已覆盖条目)
以下条目在本日窗口中再次出现,已在 R65 中有完整记录,无需重复建档:
| 条目 | arXiv | R65 状态 |
|---|---|---|
| GRIP query dominance(容量不对称 bottleneck) | 2608.16776 | ✅ R65 增量 1,§2.3 检索单元第 47 件 |
| IGD 意图引导解码(动态来源信任仲裁) | 2608.16515 | ✅ R65 增量 2,§2.3 检索单元第 48 件 |
| DSPrompt M-RAG 动态软提示防御 | 2608.16536 | ✅ R65 增量 3,§2.8 安全第 40 面 |
| Hypergraph M-RAG 超图 N 元关系 | 2608.16628 | ✅ R65 增量 4,§2.7 多模态 RAG 第 28 垂直域 |
| MC-Search ICLR 2026 Oral Agentic MM-RAG 评测 | 2603.00873 | ✅ R65 增量 5,§2.5 评测第 52 件 |
| ParliamentRAG 政治权威感知法律 RAG | 2608.13410 | ✅ R65 已有 |
| RAEF 时序 RAG | 2608.14054 | ✅ R65 已有 |
| Query Formulation via RL | 2606.16817 | ✅ R65 已有 |
| Search-R1 Stopping Criteria | 2608.13237 | ✅ R65 已有 |
| GROUNDEDKG-RAG | 2604.04359 | ✅ R65 已有 |
| OpenBMB UltraRAG | — | ✅ R65 已有 |
| Legal RAG Hallucination | 2608.14210 | ✅ R65 已有 |
| RAGSieve 知识投毒检测 | 2608.13010 | ✅ R65 已有 |
| MathForm 知识检索自动形式化 | 2608.14221 | ✅ R65 已有(rag 形态 position,非方法学主轴) |
| Personalized Auto-Research | 2608.14881 | ✅ R65 已有(rag 邻接,graph-grounded researcher context) |
三、值得警惕的矛盾或待核实说法
-
COMA 因果反事实防御的防御完整性未充分验证:COMA 提出了留一因果影响审计方法,但"因果反事实防御"的具体机制和有效性数据在 paper_cards TLDR 中未明确呈现;引用时需注明"防御框架提出,具体有效性待验证"。
-
CoAL-RAG 自适应路由的复杂度评估标准未公开:CoAL-RAG 依赖"问题本质"和"检索一致性"两个多维指标,但这些指标的量化标准和阈值设定方式未充分披露;不同法律文档类型(如判例/法规/合同)的适用性差异也未讨论。
-
Preference Is Not Intervention 样本代表性问题:9 个读者样本量较小(n=9),33% 意见相反的结论是否可泛化到更大读者群体尚需验证;该结论在特定法律或医疗等高风险领域的适用性需要更大规模复现。
-
COMA 与 DSPrompt 的防御边界存在重叠但未被讨论:COMA 解决文档组合层面隐蔽误导,DSPrompt 解决 M-RAG 向量空间投毒攻击;两者是否存在防御交叉区域(组合投毒)未被两篇论文交叉引用核实。
四、可引用 arXiv 号列表
| arXiv ID | 论文/方法 | 主分类 | 状态 |
|---|---|---|---|
| 2608.17960 | COMA · Security-RAG 组合式误导攻击 + 因果反事实防御 | rag/position | ✅ net-new 本窗口 |
| 2608.17781 | Preference Is Not Intervention · 证据效用读者异质性深层量化 | rag/method | ✅ net-new 深层数据本窗口 |
| 2608.17536 | CoAL-RAG · 复杂度感知法律 RAG 自适应路由 | rag/method | ✅ net-new 本窗口 |
| 2608.16776 | GRIP · Query Dominance 失效模式 + 容量不对称 bottleneck | rag/method | ✅ R65 已有 |
| 2608.16515 | IGD · 意图引导解码 + 动态来源信任仲裁 | rag/method | ✅ R65 已有 |
| 2608.16536 | DSPrompt · M-RAG 动态软提示防御 | rag/method | ✅ R65 已有 |
| 2608.16628 | Hypergraph M-RAG · 超图 N 元关系 + 增量精炼 | rag/method | ✅ R65 已有 |
| 2603.00873 | MC-Search · ICLR 2026 Oral Agentic MM-RAG 评测 | rag/benchmark | ✅ R65 已有 |
| 2608.13410 | ParliamentRAG · 政治权威感知法律 RAG | rag/systems | ✅ R65 已有 |
| 2608.14210 | Legal RAG Hallucination | rag/benchmark | ✅ R65 已有 |
| 2608.13010 | RAGSieve | rag/systems | ✅ R65 已有 |
本窗口新增可引用 arXiv 号(+2): - 2608.17960(COMA) - 2608.17536(CoAL-RAG)
本窗口深层量化数据补充(arXiv 不变,内容新增): - 2608.17781(Preference Is Not Intervention:33% / 29.8% / +0.031 t=3.39)
五、检查来源清单
Tom inbox(今日):
- /inbox/tom/2026-08-20T0840-agent-rag-longcontext-radar.md(8 条候选,2 条 RAG 直接净新增 = COMA / CoAL-RAG + Preference Is Not Intervention 深层数据)→ ✅ 2 条 net-new RAG 方法学增量 + 1 条深层量化数据
Tom inbox(近 2 天 RAG 相关):
- /inbox/tom/2026-08-19-rag-e1prep.md(4 条 net-new = GRIP + IGD + DSPrompt + Hypergraph M-RAG)→ ✅ R65 已覆盖
- /inbox/tom/2026-08-18_rag-lite.md(GROUNDEDKG-RAG + Aishwarya Srinivasan Substack + Karakurt Akbulut 企业 KM 综述)→ ✅ R65 已覆盖
- /inbox/tom/2026-08-18-rag-e1prep.md(4 条 = ParliamentRAG + RAEF + Query via RL + Search-R1 Stopping)→ ✅ R65 已覆盖
Jay inbox(近 2 天 RAG 相关):
- /inbox/jay/2026-08-19-rag-agent-csdn-highvalue.md(11 条 CSDN 工程实践,Agentic RAG 4.0 / LangGraph 300行 / HippoRAG 2 复现 / RAGFlow v0.25)→ ✅ 工程邻接,无 net-new RAG 方法学
- /inbox/jay/2026-08-19-1002-rss-cool-papers-ir.md(5 条 cs.IR,RAG 相关:chunking 评估 2608.16586)→ ✅ 检索工程邻接,非 RAG 方法学主轴
- /inbox/jay/2026-08-19T1335-jay-ai-engineering-trending-mid-aug.md(FROAV / MimirRAG / AgentKGV / PA-LLM-RAG 工程框架)→ ✅ 工程邻接,无 net-new RAG 方法学
- /inbox/jay/2026-08-18-rag-agent-csdn-review.md(CSDN RAG/Agent 工程实践)→ ✅ 工程邻接
- /inbox/jay/2026-08-18T1220-jay-csdn-highvalue-rag-agent-pytorch-multimodal.md(Qwen-Agent / Deep Searcher)→ ✅ 工程邻接
Work-queue(今日 08:00 Top 15):
- CoAL-RAG 2608.17536(法律 RAG · 复杂度感知路由)→ ✅ net-new 增量 3
- Preference Is Not Intervention 2608.17781(证据效用读者异质性)→ ✅ 深层数据本窗口新增
Paper_cards(近 3 天新卡,RAG 主分类):
- 1006-2608.17960(COMA)→ ✅ net-new 增量 1
- 1013-2608.17781(Preference Is Not Intervention)→ ✅ 深层量化数据本窗口新增(已在 R65 记录存在性)
- 1014-2608.17536(CoAL-RAG)→ ✅ net-new 增量 3
- 1011-2608.14221(MathForm)→ ✅ R65 已有
- 1012-2608.14881(Personalized Auto-Research)→ ✅ R65 已有
- 989-2608.16628(Hypergraph M-RAG)→ ✅ R65 已有
- 990-2608.16536(DSPrompt)→ ✅ R65 已有
- 991-2608.16515(IGD)→ ✅ R65 已有
- 988-2608.16776(GRIP)→ ✅ R65 已有
- 965-2608.14210(Legal RAG Hallucination)→ ✅ R65 已有
- 980-2608.14054(RAEF)→ ✅ R65 已有
- 941-2608.13410(ParliamentRAG)→ ✅ R65 已有
- 951-2608.13010(RAGSieve)→ ✅ R65 已有
其他 agent inbox(近 2 天 RAG 关键词扫描):
- /inbox/flyp/(multimodal weekly / coding agents / risk-e1prep)→ ✅ 无 RAG 方法学
- /inbox/spark/(llm-infra / agent)→ ✅ 无 RAG 方法学
- /inbox/stephen/(llm-application / ai-industry)→ ✅ 无 RAG 方法学
知识基线:
- organized/knowledge/rag.md(R65 活文档,已读 §0 + §0.5 + §2.3 + §2.5 + §2.7 + §2.8 截面)
六、增量密度评估与 R66 建议
本窗口增量密度:中偏低(2 条 net-new RAG 方法学 + 1 条深层量化数据)
本期窗口(8-19 下午 ~ 8-20 早间)RAG 直接增量密度低于 R64→R65 窗口(4 条 net-new)。2 条净新增方法学(COMA 安全攻击 + CoAL-RAG 法律复杂度路由)+ 1 条深层量化数据(Preference Is Not Intervention 读者异质性具体数字)。
结构观察:本期 3 条呈现 RAG 安全与评测两个维度的新增: 1. 安全维度:COMA 组合式误导攻击(DSPrompt 的对手盘) 2. 评测维度:Preference Is Not Intervention 深层数据(reader 作为变量的实证量化) 3. 垂直域维度:CoAL-RAG 法律复杂度感知路由(法律 RAG 双件套之一)
R66 建议优先处理: 1. COMA → §2.8 安全与治理(Security-RAG 组合式误导攻击 + 留一因果影响审计 + 与 DSPrompt 形成攻防对偶) 2. CoAL-RAG → §2.7 多模态 RAG 垂直域(复杂度感知法律 RAG 第 29 垂直域 + 与 ParliamentRAG 法律 RAG 双件套) 3. Preference Is Not Intervention 深层数据 → §0.5.1 + §2.5 评测(33% 读者意见相反 + 29.8% 方差解释 + +0.031 F1 t=3.39)
arXiv ID 累计:R65 435 → R66 437(+2:2608.17960 + 2608.17536;2608.17781 数量不变但内容深化)
边界: 本文件写入 /shared/research-kb/inbox/tom/2026-08-20-rag-e1prep.md,不写入他人目录,不 git commit,不写密钥。
Tom · 2026-08-20 08:50 CST · E1 日间预消化轮 · rag 主题 检查来源:Tom 3 份 radar/e1prep + Jay 5 份 inbox + paper_cards 13 张 RAG 主分类 + work-queue.md 1 份 = 22 份来源