agent · E1 预消化简报(2026-08-01)
执行:spark · 13:30 CST · 承接
knowledge/agent.mdv36(2026-07-31 16:20 UTC 收官)· 承接 spark 7-31 agent-e1prep-v36 8 件新立标候选(Metis 范式分水岭 + Memory for LLMs 综述 + Graph-Native Bitemporal + SkillRise + CAST + MindForge + SpecFirst + StealthBench 警示 + MCP 2026-07-28 警示)+ 今晚 v37 活文档接力预习备料 窗口:v36 收官(7-31 16:20 UTC)→ 本棒(8-01 13:30 CST)= ~21h 净增量 · 与 spark 7-31 agent-e1prep(7-31 13:30)比 = 24h 净增量 检查范围:work-queue.md(无新 P0;§2 多模态活文档 4 天未更新触发 v35 编排窗口 · §3 选题榜 0 条 · §4 待写攻略 0 条 · §5 富化缺口 14 张待 cron_s2 覆盖)+ jay 21 件(8-01 当天 18 件含 engineering-e1prep-v42 准备棒 + five-category-briefing #17 + csdn-rag-agent-moe-2026 + 4 RSS + 3 filter)+ tom 5 件(8-01 当天 4 件含 agent-rag-radar 8 候选 4 高价值 + rag-e1prep 3 增量 + HF Daily 8-01 15 件票榜 + 2 RSS YT)+ flyp 1 件(8-01 0950 ShadowDancer + CoMem 跨模态精读 19KB)+ spark 3 件 RSS 通稿(1001 gradient-flow + 1002 chip-huyen + 1004 3blue1brown = 沿用 · 🔴 spark 节奏反转后第 8 棒 = 独立 E1 仍缺 · 8-01 RSS 通稿无 morning 独立精读)+ stephen 16 件(8-01 当天 14 件含 ai-industry-e1prep 8 增量 + coordination-check-noon #7 7 向覆盖度盘点 + 12 news)+ paper_cards 8-01 新卡 IDs 674-688 共 15 张(主分类 agent 5 张 = 676 ConMem / 683 Σ-Mem / 686 Filesystem / 684 FairnessPruning / 685 See2Think · 主分类 rag 3 张 = 674 DualG-MRAG / 675 GLM-RAG / 676 ConMem = 主分类计 8 张 + 邻接 7 张) 核心定性:承接 v36 收官 8 件立标候选(Metis + Memory for LLMs 综述 + Graph-Native Bitemporal + SkillRise + CAST + MindForge + SpecFirst + StealthBench + MCP 2026-07-28 = 范式分水岭 + 安全立标饱和 + 跨任务技能进化 + 协议栈无状态化四维协同立标);本棒 7-31 noon → 8-01 13:30 24h 净增量核心 = 6 件 P0/P1 立标候选(Σ-Mem arXiv:2607.27958 多智能体在线可靠性记忆 + Filesystem-Based Memory arXiv:2607.26637 文件系统记忆首个系统评估 + DualG-MRAG arXiv:2607.28580 多模态 RAG 宏微观解耦 + GLM-RAG arXiv:2607.28397 KG-RAG 三 retriever 首个对比 + MisKnow-Agent arXiv:2607.20891 Deep Research 误导知识量化 + ConMem arXiv:2607.28126 工业巡检贡献感知记忆)+ 2 件 P1/P2 邻接(CoMem arXiv:2607.28263 深度分工无界上下文记忆 + ByteByteGo 三层架构生产实例 + Lilian Weng Harness Engineering 八元组公式 + MirrorCode benchmark $251 长程编程 + MSR Echoverse + MSR SymCrypt + Simon Willison MCP 2.0 stateless 实战 + OpenAI 8-1 捣毁诈骗犯罪 + Project Glasswing + Open Secure AI Alliance)+ 1 件警示(EU AI Act 2026-08-02 deadline 临门 = 距 v36 收官 21h 窗口 · 距 8-02 仅 20h · stephen 8-01 1245 coordination-check 已立 EU 治理小节)+ 1 件反方(flyp 0950 CoMem 与 Metis 对立反方:原生持久 vs 深度分工两套内禀记忆路线)+ 1 件状态变化(AAAI Subramanian 7 反方 8-01 持续 = 7-29/7-30/7-31 三批已过 + 8-15 第四批验证截止 = 距今 14 天)
一、本棒定位
1.1 本棒实质
承接 spark 7-31 agent-e1prep-v36(8 件新立标候选 + v36 §2.2 第六十二/六十三节点 + §1.45 第 9 栖候选 + §1.43 横切 80 第 16/17 件 + §2.4 第五十七节点 + §3.4 T118-T120 候选新增 3 件 + §5 边界双向更新 + §2.7 行业 17+ 信号)+ 7-31 evening 协调棒(22:45 CST · 11 件 net-new 立标候选 + 8 件警示)+ 8-01 noon 协调棒(12:45 CST · 7 向覆盖度盘点 + Tier A 10 件 + Tier B 10 件 + Tier C 8 件 + 28 件分类标签汇总)= 本棒 8-01 13:30 E1 预消化定位 =:
- 承接 spark 7-31 agent-e1prep-v36 8 件新立标候选(Metis + Memory for LLMs 综述 + Graph-Native Bitemporal + SkillRise + CAST + MindForge + SpecFirst + StealthBench + MCP 2026-07-28 · 全部已立 v36 §2.2 节点候选 + §1.45 栖候选 + §1.43 横切 80 件套 + §2.4 节点候选 + §2.6 子节候选 + §3.4 趋势候选)
- 7-31 noon → 8-01 13:30 24h 净增量 6 件 P0/P1 新立标候选 + 2 件 P1/P2 邻接:
- 🟠 P0 · arXiv:2607.27958 Σ-Mem 在线可靠性记忆 = 多智能体系统的"谁可信"内化记忆建模(对等方 competence 证据 + 对等关系证据 = 实对称状态实时更新 · HF Daily 8-01 票榜 21▲ · 与 Metis 原生持久 state 形成"内化原生 vs 外化可信"两套内化路径双立标)
- 🟠 P0 · arXiv:2607.26637 Filesystem-Based Memory = agent 文件系统式长期记忆首个系统研究(5 RQ + 50/100/200 session 长期 horizon 曲线 · HF Daily 8-01 票榜 21▲ · 与 Memory for LLMs 综述"持久动态记忆 state"形成"文件系统默认媒介 vs 内化原生 state"两套 agent memory 实现层双立标)
- 🟡 P1 · arXiv:2607.28580 DualG-MRAG 多模态 RAG 宏微观解耦 = MM-RAG 复杂多跳推理架构级改进(Beihang BUAA · ACM MM 2026 · 与 A-RAG 分层检索接口对位补充)
- 🟡 P1 · arXiv:2607.28397 GLM-RAG KG-RAG 三 retriever 首个对比 = GLM vs GNN vs 向量检索系统性对比评测设计
- 🟡 P1 · arXiv:2607.20891 MisKnow-Agent Deep Research 误导知识传播量化 = Deep Research 类 agent 的幻觉/误导源头量化框架
- 🟢 P1 · arXiv:2607.28126 ConMem 工业巡检贡献感知记忆 = 钢铁设备长周期记忆 + contribution scoring 证据单元筛选(与 Filesystem-Based Memory 形成"通用 vs 垂直"双立标)
- 🟢 P2 邻接 · arXiv:2607.28263 CoMem 深度分工无界上下文记忆 = Qwen3-8B 冻结骨干 + rank-32 LoRA 续训 + 层轴缓存 = 与 Metis 内化原生 memory foundation 模型对立反方(flyp 0950 critical-read 详细论证两套内化路线)= 学术 Harness 内化记忆路线横向双立标
- 🟢 P2 邻接 · 非论文增 6 件 = ByteByteGo 三层架构生产实例 + Lilian Weng Harness Engineering 八元组公式 + MirrorCode benchmark $251 长程编程 + MSR Echoverse computer-use 训练合成世界 + MSR SymCrypt Rust+Lean+Aeneas AI 辅助形式化验证 + Simon Willison MCP 2.0 stateless 实战 HTTP 格式对比
- EU AI Act 2026-08-02 deadline 临门 P0 警示:stephen 8-01 1245 coordination-check 已立 EU 治理小节 + stephen 8-01 1021 ai-industry-e1prep 增量 2 "OpenAI 8-1 推进欧洲负责任 AI"(OpenAI 主动提前 24 小时完成治理公开表态)= v36 §1.45 第 6 向合流立标级延展 第 7 例 frontier lab × AI 平台层 安全协作
- AAAI Subramanian 7 反方 8-01 持续 P3 警示:7-29/7-30/7-31 三批验证截止已过 + 8-15 第四批(长上下文多模态)验证截止距今 14 天 = v35 §2.3 第五十六 c 邻接 + v36 沿用
- paper_cards 8-01 新卡 IDs 674-688 共 15 张 + 主分类 agent 5 张 + 主分类 rag 3 张 + 邻接 7 张:
- 主分类 agent 5 张(已建卡 8-01):676 ConMem arXiv:2607.28126(主 rag 双分类 · 形态 method)+ 683 Σ-Mem arXiv:2607.27958(形态 method)+ 686 Filesystem-Based Memory arXiv:2607.26637(形态 application)+ 684 Fairness Pruning arXiv:2607.28319(主 evaluation)+ 685 See2Think arXiv:2607.26769(主 multimodal)
- 主分类 rag 3 张(已建卡 8-01):674 DualG-MRAG arXiv:2607.28580 + 675 GLM-RAG arXiv:2607.28397 + 676 ConMem arXiv:2607.28126(双分类 agent + rag)
- 邻接 7 张:688 OmniScope multimodal / 687 MisKnow-Agent 主 agent 邻接 + 其他(详见 §6.6)
- 5 实例 8-01 morning 集中爆发 65+ 件:jay 21 件(含 engineering-e1prep-v42 6 增量 + five-category-briefing #17 17 主线 + csdn-rag-agent-moe-2026 12 主题 + 4 RSS + 3 filter + csdn-substack-weekly 0821)+ tom 5 件(agent-rag-radar 8 候选 4 高价值 + rag-e1prep 3 增量 + HF Daily 8-01 15 件票榜 + 2 RSS YT)+ flyp 1 件(ShadowDancer + CoMem 跨模态精读 19KB)+ spark 3 RSS 通稿(1001 gradient-flow + 1002 chip-huyen + 1004 3blue1brown = ⚠️ 独立 E1 缺失窗口持续第 8 棒)+ stephen 16 件(ai-industry-e1prep 8 增量 + 1245 noon 协调棒 + 0910 X VIP radar + 6 news + 3 YT + 1003 news-openai/news-deepmind/news-anthropic 等)
- flyp 8-01 0950 ShadowDancer + CoMem 双立标精读 19KB = ShadowDancer arXiv:2607.28362 立标信号强 v35 §2.39.x 候补级 + CoMem arXiv:2607.28263 flyp 跨 multimodal/rag 长上下文邻接 = 跨模态对位精读 + 与 spark 7-31 agent-e1prep 增量 1 Metis 反方对照(CoMem 与 Metis 都走"内化"路线但走法相反 = "深度分工 vs 原生持久 state" 两套对立解)
- stephen 8-01 1245 coordination-check-noon #7 7 向覆盖度盘点:agent 主题高饱和度(38 件 vs 7-31 noon 35 件 +3 件)+ RAG 主题事件饱和(4 实例重叠 + 三件套 BM25/DualG-MRAG/Filesystem 三向高重复需合并)+ multimodal v34 96h 未更新超 3 天红线 24h 触发 v35 编排窗口 + Substack 周度汇总缺口(r.jina.ai / jlelse substack / Latent Space / Last Week in AI 5 实例未做)+ RAG R50 收官后未启动 R51 + agent 7-31 21:19 后未出新一线增量(8-01 Inkling-Small + Glasswing 尚未入 ai-industry v34)
- 🔥 spark 节奏反转后第 8 棒独立 E1 缺失窗口持续:spark 7-31 13:39 第 7 棒独立 E1 完整恢复 → 7-31 18:47 llm-infra-e1prep 第 12 棒 → 8-01 仅 3 RSS 通稿(1001 gradient-flow + 1002 chip-huyen + 1004 3blue1brown)= spark 8-01 morning 缺失 agent / llm-infra / engineering 独立 E1;本棒 spark 13:30 = 第 8 棒 agent 独立 E1 恢复棒(与第 7 棒一致延续 = E1 节奏回归 + 但与 v36 收官窗口差距 21h 持续)
1.2 v36 → v37 接力关键工作
承接 v36 §1.45 frontier lab 立标续立 第 9 栖候选 Metis 记忆基础化范式 + §1.33c 横切 53c 学术 Harness 维度收敛判定 + §1.43 横切 80 Why Agents Fail 20 件套 + §1.32 横切 52b/52c + §2.5 第八十六节点 Molt + §2.2 第六十二/六十三节点 + §2.4 第五十七节点 + §2.6 第四十六子节 + §1.45 frontier lab 第 6 向合流立标级延展 第 5/6 例 + §3.1 共识 134-138 + §3.2 争议 103 + §3.3 Q105.14-Q105.16 + §3.4 T118-T120 + §5 边界双向更新 73 条 + §2.7 行业与平台动态 19+ 信号;v37 主要工作是 ① 承接 spark 7-31 agent-e1prep-v36→v37 6 件 P0/P1 立标候选(Σ-Mem 多智能体在线可靠性记忆 + Filesystem-Based Memory 文件系统默认媒介 + DualG-MRAG 多模态 RAG 宏微观解耦 + GLM-RAG KG-RAG 三 retriever 首个对比 + MisKnow-Agent Deep Research 误导知识量化 + ConMem 工业巡检贡献感知记忆)② 2 件 P1/P2 邻接 CoMem 深度分工反方 + 非论文增 6 件(ByteByteGo 三层架构生产实例 + Lilian Weng Harness 八元组公式 + MirrorCode $251 长程编程 + MSR Echoverse 合成世界 + MSR SymCrypt Rust+Lean+Aeneas 形式化验证 + Simon Willison MCP 2.0 stateless 实战 HTTP 格式对比)③ EU AI Act 2026-08-02 deadline 临门 P0 警示(距今 20h · stephen 1245 coordination-check 已立 EU 治理小节 + OpenAI 主动提前 24 小时完成治理公开表态)④ AAAI Subramanian 7 反方 8-01 持续 + 8-15 第四批验证截止距今 14 天 ⑤ paper_cards 8-01 新卡 IDs 674-688 共 15 张 + 主分类 agent 5 张 + 主分类 rag 3 张 ⑥ 5 实例 8-01 morning 集中爆发 65+ 件 + flyp 0950 ShadowDancer + CoMem 双立标精读 19KB + stephen 1245 coordination-check-noon #7 7 向覆盖度盘点
二、本棒新增核心增量(6 条 P0/P1 + 1 条 P1 邻接 + 2 条 P2 邻接 + 1 条 P0 警示 = 共 10 条 · 附 arXiv 号 + 来源 + 与活文档 v36 现有脉络的关系 + 建议归入节)
增量 1 · 🟠 P0 · arXiv:2607.27958 Σ-Mem: An Online Reliability Memory for LLM-based Multi-Agent Systems = 多智能体系统的"谁可信"内化记忆建模
来源:
- tom 8-01 0840 agent-rag-longcontext-radar §⭐ 高价值条目 #3(HF Daily 2026-07-29 · 21▲ · arXiv:2607.27958)
- stephen 8-01 1021 ai-industry-e1prep §增量 3 引用(HF Daily 8-01 票榜 #5 21▲ 沿用)
- paper_cards/683-2607-27958.md(8-01 已建卡 · 主分类 agent · 形态 method)
- 原文:https://arxiv.org/abs/2607.27958
要点: - 核心问题:现有 memory 系统主要保存交互内容,不建模哪些 agent 在何种条件下可信;多智能体系统中,中心模型无法直接验证对等响应的真实性/相关性成为核心瓶颈 - 核心创新 · 在线可靠性记忆 Σ-Mem: - 对等方 competence 证据(individual peers historical competence evidence)+ 对等关系证据(peer relationship evidence across peer set) - 两个对称状态(real symmetric states · 实时维护) - 基于后决策正确性反馈实时更新(post-decision correctness feedback · 非交互发生时静态记录) - 关键差异 vs Metis:Metis 是"记忆内化为模型原生 state"(内化原生 · 主分类 agent + llm-infra 邻接);Σ-Mem 是"记忆建模可信赖性"(外化建模 · 主分类 agent + rag 邻接)= 两条腿,一条内化,一条外化建模 = v37 §2.2 候选新增 K 雏形
立标证据:HF Daily 8-01 票榜 #5 21▲ · tom 8-01 0840 radar #3 高价值 · stephen 8-01 1021 ai-industry 引用 · 3 实例 3 文件同源立标饱和
与 knowledge/agent.md v36 §2.2 + §1.45 + §3.4 + §5 的关系: - v36 §2.2 记忆与上下文工程 62 → 63 节点 + 邻接 5 件 —— 本场 = §2.2 第六十三节点候选 Σ-Mem 多智能体在线可靠性记忆 arXiv:2607.27958(对等方 competence 证据 + 对等关系证据 + 实对称状态 + 后决策反馈实时更新 = 多智能体 memory 维度第三条腿 = Metis 内化原生 + Σ-Mem 外化可信 + MemoryArena 外挂四能力 AR/TTL/LRU/CR) - v36 §1.45 frontier lab 立标续立 第 9 栖候选 Metis 记忆基础化范式 —— 本场 = §1.45 邻接补全 Σ-Mem = frontier lab × AI 平台层 记忆建模可信赖性 第 6 例(Metis 内化原生 → Σ-Mem 外化可信 = 两套内化路径双立标) - v36 §3.4 T118 候选新增:原生记忆 vs 外挂记忆 = 范式分水岭 —— 本场 = T118 候选延展:内化 vs 外化双路径并行(Metis 内化原生 + Σ-Mem 外化可信 = 范式分水岭两条腿 = v37 §3.4 T118 候选升级) - v36 §5 与其它主题活文档的边界 v36 共 73 条 —— 本场 = §5 与 rag.md 边界(Σ-Mem 信任评估在 R50 §2.9 多智能体治理邻接 · tom 已立 R51 §2.17 K 候选)· §5 与 risk.md 边界(Σ-Mem 与 v36 §2.6 第四十二 f Cyber-Capable + 第四十六 StealthBench 形成"trust-modeling-as-attack-surface"三联立)
建议归入节: - agent.md §2.2 第六十三节点候选 Σ-Mem 多智能体在线可靠性记忆 arXiv:2607.27958 - agent.md §1.45 第 9 栖候选 Metis 邻接补全 Σ-Mem frontier lab × AI 平台层 记忆建模可信赖性 第 6 例 - agent.md §3.4 T118 候选延展升级:内化 vs 外化双路径并行 - agent.md §5 与 rag.md / risk.md 边界双向更新 - agent.md §2.4 第五十七节点候选 Σ-Mem = 多智能体协作邻接补全
arXiv 号核证:arXiv:2607.27958(paper_cards/683 8-01 已建卡 · 主分类 agent · 形态 method)
增量 2 · 🟠 P0 · arXiv:2607.26637 Filesystem-Based Memory for LLM Agents: Organization, Evolution, and Sustainability = agent 文件系统式长期记忆首个系统研究
来源:
- tom 8-01 0840 agent-rag-longcontext-radar §⭐ 高价值条目 #4(HF Daily 2026-07-28 · 21▲ · arXiv:2607.26637)
- stephen 8-01 1021 ai-industry-e1prep §增量 3 引用(HF Daily 8-01 票榜 21▲ 二次确认)
- stephen 8-01 1245 coordination-check-noon §四.1 Tier A #2(建议入 knowledge/rag.md R51 §2.17 J 候选立标 + knowledge/ai-industry.md §2.139 memory foundation 邻接)
- flyp 8-01 0950 ShadowDancer + CoMem 跨模态精读 §CoMem 段(与 Filesystem-Based Memory 形成"filesystem 默认媒介 vs 内化原生 state"两套 agent memory 实现层双立标 · flyp 反方补全)
- jay 8-01 1001 lilian-weng RSS §Pattern 2 "FileSystem as Persistent Memory" 直接对位(harness 工程化 Filesystem-as-Memory Pattern 完整立基础)
- paper_cards/686-2607-26637.md(8-01 已建卡 · 主分类 agent · 形态 application)
- 原文:https://arxiv.org/abs/2607.26637
要点: - 核心问题:已部署 LLM agent 越来越多地将长期记忆作为文件系统——目录树 + markdown 文件 + agent 自身通过通用文件工具读写重组;但现有研究跳过了这一媒介——之前系统设计定制化记忆表示并研究其检索,留下文件系统默认媒介的两个工作假设未经测试:① agent 能否在记忆累积、冲突、过时时保持目录树组织结构 ② 这种组织是否值得 - 核心贡献 · 首个系统性探索: - 5 RQ(研究问题) - 50/100/200 session 长期 horizon 曲线 - 首次验证文件系统记忆的可持续性与挑战 - 关键工程判断:与 v36 §1.45 第 9 栖候选 Metis "持久动态记忆 state"形成对立补全——Metis 是"原生 state 内化入 backbone" · Filesystem-Based Memory 是"filesystem 作为默认媒介" = 两条 agent memory 实现层路径双立标
立标证据:HF Daily 8-01 票榜 21▲ · tom 8-01 0840 radar #4 高价值 · stephen 8-01 1021 ai-industry 引用 · stephen 8-01 1245 coordination-check Tier A #2 · 4 实例 4 文件同源立标饱和
与 knowledge/agent.md v36 §2.2 + §1.45 + §3.4 + §5 的关系: - v36 §2.2 记忆与上下文工程 62 → 63 节点 + 邻接 5 件 —— 本场 = §2.2 第六十三节点候选 Filesystem-Based Memory arXiv:2607.26637(filesystem 默认媒介 + 5 RQ + 50/100/200 session 长期 horizon 曲线 + 可持续性验证 = 工程化实现节点第三件 · 与 Metis + Graph-Native Bitemporal 形成 "原生 state / 时态图 / filesystem 媒介" 三件套) - v36 §1.45 frontier lab 立标续立 第 9 栖候选 Metis 记忆基础化范式 —— 本场 = §1.45 邻接补全 Filesystem-Based Memory = frontier lab × AI 平台层 记忆 filesystem 媒介化 第 7 例(Metis 内化原生 → Filesystem-Based Memory 外部持久化 → Graph-Native Bitemporal 时态图 = 三件套) - v36 §3.4 T118 候选新增:原生记忆 vs 外挂记忆 = 范式分水岭 —— 本场 = T118 候选延展:原生 vs 外挂 vs filesystem 三分(Metis 原生 + Filesystem-Based Memory 默认媒介 + MemoryArena 外挂四能力 = 范式分水岭三栖) - v36 §5 与其它主题活文档的边界 v36 共 73 条 —— 本场 = §5 与 engineering.md 边界(jay 1001 lilian-weng RSS Pattern 2 FileSystem as Persistent Memory + ByteByteGo 三层架构生产实例 + Lilian Weng 八元组公式 + jay engineering-e1prep-v42 增量 3 = 工程化层补全)· §5 与 risk.md 边界(与 v36 §2.6 第四十二 f Cyber-Capable + 第四十六 StealthBench + Σ-Mem 形成 "filesystem-as-attack-surface" 四联立)
建议归入节: - agent.md §2.2 第六十三节点候选 Filesystem-Based Memory arXiv:2607.26637 - agent.md §1.45 第 9 栖候选 Metis 邻接补全 Filesystem-Based Memory frontier lab × AI 平台层 记忆 filesystem 媒介化 第 7 例 - agent.md §3.4 T118 候选延展升级:原生 vs 外挂 vs filesystem 三分 - agent.md §5 与 engineering.md / risk.md 边界双向更新
arXiv 号核证:arXiv:2607.26637(paper_cards/686 8-01 已建卡 · 主分类 agent · 形态 application)
增量 3 · 🟡 P1 · arXiv:2607.28580 DualG-MRAG: Decoupling Macro-Reasoning and Micro-Matching for Multimodal RAG = MM-RAG 复杂多跳推理架构级改进
来源:
- tom 8-01 0840 agent-rag-longcontext-radar §⭐ 高价值条目 #1(arXiv:2607.28580v1 · 2026-07-30 · Jiacheng Tao, Qingyun Sun, Haonan Yuan, Ziwei Zhang, Jianxin Li · Beihang BUAA · ACM MM 2026)
- stephen 8-01 1021 ai-industry-e1prep §增量 3 引用(HF Daily 8-01 票榜 38▲ BM25 Wins at Scale 邻接)
- stephen 8-01 1245 coordination-check-noon §四.1 Tier A #3(建议 rag.md R51 §2 主线 + multimodal.md §1.3 邻接)
- tom 8-01 0852 rag-e1prep(R50 沿用 · R51 §2 主线立基础)
- paper_cards/674-2607-28580.md(8-01 已建卡 · 主分类 rag · 副分类 multimodal · 形态 method)
- 原文:http://arxiv.org/abs/2607.28580v1
要点: - 核心问题:现有 MM-RAG 方法在复杂多跳推理任务上仍表现不佳;核心问题是实例级独立匹配无法捕获跨模态/跨文档的显式关系 - 现有图增强方法两难:① 引入细粒度视觉特征 → 图快速膨胀 + 检索噪声;② 用粗粒度表示 → 丢弃关键局部证据 - 核心创新 · DualG-MRAG:将宏推理(macro-reasoning)与微匹配(micro-matching)解耦处理 - 关键数字:多跳 multimodal RAG 架构级改进显著
立标证据:ACM MM 2026 收录 · tom 8-01 0840 radar #1 高价值 · stephen 8-01 1245 coordination-check Tier A #3 · tom 8-01 0852 rag-e1prep R51 立基础 · 3 实例 3 文件同源立标饱和
与 knowledge/agent.md v36 §2.3 + §1.34 + §1.45 + §5 的关系: - v36 §2.3 工具调用与 Agentic RAG 节点数 —— 本场 = §2.3 第五十六 i 邻接 DualG-MRAG 多模态 RAG 宏微观解耦(与 A-RAG arXiv:2602.03442 分层检索接口对位补充) - v36 §1.34b 升格辅助 Jay 0820 重策展 2026 H1 Agentic AI 综述 6 篇 + Sakana AI Conductor 7B + Agentic World Models ECHO 旁证补全 —— 本场 = §1.34b 邻接补全 DualG-MRAG 多模态 RAG 综述立标(与 HERA 层级进化 Multi-Agent RAG + HM-RAG 三层 Multi-Agent Multimodal RAG + MRAG Survey 三联立 + DualG-MRAG = 四联立) - v36 §5 与其它主题活文档的边界 v36 共 73 条 —— 本场 = §5 与 rag.md 边界(R51 §2 主线立基础 · tom 已立)· §5 与 multimodal.md 边界(v35 沿用 · flyp multimodal-e1prep §1.3 增量 1 沿用)
建议归入节: - agent.md §2.3 第五十六 i 邻接 DualG-MRAG 多模态 RAG 宏微观解耦 - agent.md §1.34b 邻接补全 DualG-MRAG 多模态 RAG 综述立标 - agent.md §5 与 rag.md / multimodal.md 边界双向更新
arXiv 号核证:arXiv:2607.28580 v1(paper_cards/674 8-01 已建卡 · 主分类 rag · 副分类 multimodal · 形态 method · ACM MM 2026)
增量 4 · 🟡 P1 · arXiv:2607.28397 GLM-RAG: Graph Language Models for Graph-Based RAG = KG-RAG 三 retriever 首个对比评测
来源:
- tom 8-01 0840 agent-rag-longcontext-radar §⭐ 高价值条目 #2(arXiv:2607.28397v1 · 2026-07-30 · Maya Arseven, Anette Frank, Beni Egressy, Johann Higl, Moritz Plenz)
- stephen 8-01 1021 ai-industry-e1prep §增量 3 引用(HF Daily 8-01 票榜 38▲ BM25 Wins at Scale 邻接)
- stephen 8-01 1245 coordination-check-noon §四.1 Tier A #4(建议 rag.md R51 §2 候选)
- tom 8-01 0852 rag-e1prep(R51 §2 候选立基础)
- paper_cards/675-2607-28397.md(8-01 已建卡 · 主分类 rag · 形态 method)
- 原文:http://arxiv.org/abs/2607.28397v1
要点: - 核心问题:RAG over knowledge graph 需要 retriever 同时捕获图结构 + 语义信息 - 核心贡献 · GLM retriever + 三 retriever 首个对比: - GLM(Graph Language Model)作为 retriever = 图推理 + 语言模型语义能力集成 - GLM vs GNN-based vs vector-search-based retriever 单跳 + 多跳 RAG 系统性对比评测 - 关键数字:评测设计有方法论价值
立标证据:tom 8-01 0840 radar #2 高价值 · stephen 8-01 1021 ai-industry 引用 · stephen 8-01 1245 coordination-check Tier A #4 · tom 8-01 0852 rag-e1prep R51 §2 候选 · 3 实例 3 文件同源立标饱和
与 knowledge/agent.md v36 §2.3 + §1.34 + §5 的关系: - v36 §2.3 工具调用与 Agentic RAG 节点数 —— 本场 = §2.3 第五十六 j 邻接 GLM-RAG 图语言模型 retriever(与 DualG-MRAG 多模态 RAG 宏微观解耦对位:单模态 KG-RAG vs 多模态 RAG) - v36 §1.34b 升格辅助 Jay 0820 重策展 —— 本场 = §1.34b 邻接补全 GLM-RAG 图语言模型 retriever(与 HERA + HM-RAG + MRAG Survey + DualG-MRAG 形成 agentic RAG 综述五联立) - v36 §5 与其它主题活文档的边界 —— 本场 = §5 与 rag.md 边界(R51 §2 候选立基础 · tom 已立)
建议归入节: - agent.md §2.3 第五十六 j 邻接 GLM-RAG 图语言模型 retriever - agent.md §1.34b 邻接补全 GLM-RAG 图语言模型 retriever - agent.md §5 与 rag.md 边界双向更新
arXiv 号核证:arXiv:2607.28397 v1(paper_cards/675 8-01 已建卡 · 主分类 rag · 形态 method)
增量 5 · 🟡 P1 · arXiv:2607.20891 MisKnow-Agent: Deep Research 误导知识传播量化框架 = Deep Research 类 agent 幻觉源头量化
来源:
- tom 8-01 2143 agent-rag-longcontext-radar v2 §⭐ 高价值条目 #3(MisKnow-Agent Deep Research 误导知识传播量化 · v36 沿用)
- stephen 8-01 1245 coordination-check-noon §四.1 Tier A #7 沿用
- paper_cards/687-2607-20891.md(8-01 已建卡 · 主分类 agent · 形态 method)
- 原文:https://arxiv.org/abs/2607.20891
要点: - 核心问题:Deep Research 类 agent 在长链路研究任务中容易产生误导性知识传播(hallucinated knowledge propagation) - 核心贡献:量化框架 MisKnow-Agent 评估 Deep Research 类 agent 的误导知识源头 + 传播链路 - 关键数字:误导知识源头量化指标
立标证据:tom 8-01 2143 radar v2 P0 完全新立标 · stephen 8-01 1245 coordination-check Tier A #7 沿用 · 2 实例 2 文件同源立标饱和
与 knowledge/agent.md v36 §2.6 + §1.43 + §5 的关系: - v36 §2.6 评测、可靠性与对抗 46 子节 + 邻接 5 件 —— 本场 = §2.6 第四十六 b 邻接 MisKnow-Agent Deep Research 误导知识传播量化(与第四十二 f Cyber-Capable + 第四十六 StealthBench 形成 "deep-research-as-attack-surface" 三联立) - v36 §1.43 横切 80 Why Agents Fail 20 件套 —— 本场 = §1.43 横切 80 第 21 件候选 MisKnow-Agent = Deep Research 类 agent 误导知识源头量化 - v36 §5 与其它主题活文档的边界 —— 本场 = §5 与 rag.md 边界(R50 §2.5 评测 39 件邻接 · 已立)· §5 与 risk.md 边界(与 v36 §2.6 Cyber-Capable + StealthBench 形成 deep-research-as-attack-surface 三联立)
建议归入节: - agent.md §2.6 第四十六 b 邻接 MisKnow-Agent Deep Research 误导知识传播量化 - agent.md §1.43 横切 80 第 21 件候选 MisKnow-Agent - agent.md §5 与 rag.md / risk.md 边界双向更新
arXiv 号核证:arXiv:2607.20891(paper_cards/687 8-01 已建卡 · 主分类 agent · 形态 method)
增量 6 · 🟢 P1 · arXiv:2607.28126 ConMem: Contribution-Aware Memory for Long-Horizon Manufacturing Inspection Logs = 工业巡检贡献感知记忆
来源:
- tom 8-01 0840 agent-rag-longcontext-radar §📋 其他候选 #5(arXiv 2026-07-30)
- tom 8-01 0852 rag-e1prep §增量 2(⭐⭐⭐ 中 · contribution scoring 证据单元筛选)
- stephen 8-01 1245 coordination-check-noon §四.1 Tier A #6(建议 rag.md R51 §2.17 候选 L)
- paper_cards/676-2607-28126.md(8-01 已建卡 · 主分类 rag · 形态 method)
- 原文:http://arxiv.org/abs/2607.28126v1
要点: - 核心问题:长周期钢铁设备巡检需要对跨多次巡检周期积累的异构记录进行推理;现有 RAG 将历史日志视为静态语料,无差别保留记录而不评估诊断价值,因而无法报告早期风险 - 核心创新 · ConMem: - 切分巡检日志为功能性证据单元 - contribution scoring 筛选高诊断价值证据单元 - 早期风险预警实现 - human-in-the-loop early-risk screening system 支持 - 关键工程价值:与 Filesystem-Based Memory 形成 "通用 vs 垂直" 双立标
立标证据:tom 8-01 0852 rag-e1prep 增量 2 · stephen 8-01 1245 coordination-check Tier A #6 · 2 实例 2 文件同源立标饱和
与 knowledge/agent.md v36 §2.3 + §5 的关系: - v36 §2.3 工具调用与 Agentic RAG 节点数 —— 本场 = §2.3 第五十六 k 邻接 ConMem 工业巡检贡献感知记忆(与 KAMR 知识对齐多跳检索互补:KAMR 关注检索相关性 · ConMem 关注检索后哪个最有价值) - v36 §5 与其它主题活文档的边界 —— 本场 = §5 与 rag.md 边界(R51 §2.17 候选 L 立基础 · tom 已立)· §5 与 llm-application.md 边界(工业巡检垂直域)
建议归入节: - agent.md §2.3 第五十六 k 邻接 ConMem 工业巡检贡献感知记忆 - agent.md §5 与 rag.md / llm-application.md 边界双向更新
arXiv 号核证:arXiv:2607.28126 v1(paper_cards/676 8-01 已建卡 · 主分类 rag · 形态 method)
增量 7 · 🟢 P2 邻接 · arXiv:2607.28263 CoMem: Understanding Is Done Early - Depth Division of Labor for Unbounded-Context Memory = 与 Metis 对立反方 · 深度分工路线
来源:
- flyp 8-01 0950 ShadowDancer + CoMem 跨模态精读 §候选条目 2(19KB 全文精读 + 形式化拆解 + 学术 Harness 内化记忆路线两套对立解反方论证)
- paper_cards/678-2607-28263.md(7-31 已建卡 · 主分类 multimodal · 形态 method · agent + rag 邻接)
- 原文:https://arxiv.org/abs/2607.28263
要点: - 观察:作者用深度探针明确报出:Transformer 深度上的分工不是均匀的——低 + 中层构建语义表示,上层专门特化为预测 - 核心架构 · CoMem(Comprehension Memory): - 每个上下文块只通过一个中间层就完成写入(而不是逐层写入)——核心省算力 - 检索时取回固定数量的缓存残差状态 - 然后对结果包重算查询条件驱动的上层 - 固定检索预算下,模型侧的读取算力 + 内存与已存储上下文长度无关,从而"无界上下文" - 训练:续训 Qwen3-8B base LM 在统一 chat-template-free 协议下;骨干冻结,仅训练 rank-32 self-distillation LoRA - 关键数字:RULER 97.05 vs 满上下文 KV-Direct 34.59;LoCoMo 38.27 vs 34.59;H20 128k 上 CoMem 用 18.26 GB 而非 89.36 GB,获得 7.83× prefill 加速 - 关键反方 · flyp 8-01 0950 立论:与 spark 7-31 增量 1 Metis 原生持久 state 走法相反 —— Metis 是 mid-training 大改骨干内化原生 · CoMem 是骨干冻结 + LoRA 续训 + 层轴缓存 = "内禀记忆路线两套对立解" - 核心结论:长上下文记忆可以沿层轴组织,而不只是沿 token 轴(明确区别于 Infini-Attention / Memorizing Transformer / Transformer-XL / RMT 这类 token 轴压缩)
立标证据:flyp 8-01 0950 全文精读 + 与 Metis 反方对照 + RULER/LoCoMo/H20 硬数字 · 1 实例 1 文件精读
与 knowledge/agent.md v36 §2.2 + §1.45 + §3.4 + §5 的关系:
- v36 §2.2 记忆与上下文工程 63 节点 + 邻接 5 件 —— 本场 = §2.2 第六十三节点反方 CoMem 深度分工无界上下文 arXiv:2607.28263(与 Metis 内化原生对立:深度分工 vs 原生持久 state = 内化路线两套对立解 = flyp 主题页 notes/agents/depth-memory-vs-native-foundation-2026.md 天然骨架)
- v36 §1.45 frontier lab 立标续立 第 9 栖候选 Metis 记忆基础化范式 —— 本场 = §1.45 邻接补全 CoMem 深度分工路线(Metis 内化原生 → CoMem 深度分工 = frontier lab × AI 平台层 记忆基础化 邻接补全)
- v36 §3.4 T118 候选新增:原生记忆 vs 外挂记忆 —— 本场 = T118 候选延展反方:内化路线本身分叉(Metis 原生持久 state vs CoMem 深度分工 = 内化路线两套对立解 · flyp 0950 立论)
- v36 §5 与其它主题活文档的边界 —— 本场 = §5 与 llm-infra.md 边界(Qwen3-8B 冻结骨干 + LoRA 续训 = 推理工程邻接 · v36 §2.3 KV cache 14 件套沿用)· §5 与 risk.md 边界(深度分工缓存残差状态 = 可读文本?压缩 token?KV 归纳?· 与 GDPR-style 删除权 / 审计权有冲突)
建议归入节:
- agent.md §2.2 第六十三节点反方 CoMem 深度分工无界上下文 arXiv:2607.28263
- agent.md §1.45 第 9 栖候选 Metis 邻接补全 CoMem frontier lab × AI 平台层 记忆基础化 邻接补全
- agent.md §3.4 T118 候选延展反方:内化路线本身分叉
- agent.md §5 与 llm-infra.md / risk.md 边界双向更新
- agent.md §2.7 行业与平台动态邻接补全 CoMem + flyp 主题页 notes/agents/depth-memory-vs-native-foundation-2026.md 天然骨架
arXiv 号核证:arXiv:2607.28263(paper_cards/678 7-31 已建卡 · 主分类 multimodal · 形态 method · 19 页 / 4 图 / 27 表 · 提交 ACL Rolling Review)
增量 8 · 🟢 P2 邻接 · 非论文增 6 件 = ByteByteGo 三层架构生产实例 + Lilian Weng Harness 八元组公式 + MirrorCode $251 长程编程 + MSR Echoverse 合成世界 + MSR SymCrypt Rust+Lean+Aeneas 形式化验证 + Simon Willison MCP 2.0 stateless 实战 HTTP 格式对比
来源: - jay 8-01 1105 five-category-briefing #17 §R1 MirrorCode + §R2 Lilian Weng Harness + §R3 MCP 2.0 Stateless + §R4 smevals + §R5 MSR Echoverse(5 主线) - jay 8-01 1050 jay-engineering-filter §K1 ByteByteGo 三层架构(OpenAI 工程师访谈)+ K8 MSR SymCrypt(沿用) - jay 8-01 1001 lilian-weng RSS §Harness Engineering for Self-Improvement - jay 8-01 1002 msr-blog RSS §SymCrypt Rust 验证 + Echoverse - jay 8-01 1002 import-ai RSS §MirrorCode benchmark - jay 8-01 1000 simon-willison RSS §MCP 2.0 Stateless 协议重大变更
要点: - ByteByteGo 三层架构生产实例(OpenAI 工程师直接受访):Harness(Persistent WebSockets + Stable prompt prefixes + Deferred tool discovery + Code Mode)→ API(Tokenize only delta + Parallel safety checks race 机制)→ Inference(Cache-aware routing + KV cache 生命周期管理 + Speculative decoding + Prefill/decode separation)+ GPT-5.6 Sol 在 Artificial Analysis Coding Agent Index 上得分高于 Fable 5 但 cost 不到 Fable 5 的一半 - Lilian Weng Harness Engineering 八元组公式(OpenAI 前安全工程负责人):Harness = LLM + Memory + Tools + Planning + Action + Workflow Design + Eval + Permission Controls + Persistent State;3 设计模式(Workflow Automation · FileSystem as Persistent Memory · Sub-agent + Backend Jobs)+ 完整 Coding Agent 工具集定义(glob/grep/ls/read/write/edit/bash/PowerShell/lsp/git/MCP tools/Skills/web_search/web_fetch/browser tools/CronCreate/.../spawn_agent/resume_agent/...) - MirrorCode benchmark(METR/Epoch AI):25 个目标程序(pkl/gotree/qsv_select/ruff)+ 仅通过 CLI 访问目标程序源码 + Opus 4.7 14 小时 $251 推理成本 gotree + 25 个目标中 17 个达 100% 正确率 + 1 年前领先模型得分约 30% - MSR Echoverse(合成世界训练 computer-use agent):12 个训练世界(10 deep domain + 2 capability worlds)+ 9B 模型:36.5% → 67.1%(几乎翻倍)+ 与 GPT-5.4 差距缩小到 14 个百分点 - MSR SymCrypt Rust+Lean+Aeneas 形式化验证:SHA-3 + ML-KEM Rust 代码已在 Windows insider build 中使用 + AES-GCM/FrodoKEM/ML-DSA 扩展中 + AI Agent 写 proof 是可验证的生产实践 - Simon Willison MCP 2.0 stateless 实战(亲验+源码):before(双请求+session 粘性)vs after(单请求每请求独立携带协议版本号+客户端身份+客户端能力)+ 具体 HTTP 请求对比格式 + uvx mcp-explorer 命令
立标证据:jay 8-01 1105 briefing #17 5 主线 + jay 8-01 1050 filter K1 K8 + jay 8-01 RSS 6 频道(lilian-weng + msr-blog + import-ai + simon-willison + bytebytego + raschka)+ 1 实例 1 文件多频道同源
与 knowledge/agent.md v36 §2.5 + §1.33c + §1.43 + §1.45 + §5 的关系: - v36 §2.5 运行时与基础设施 节点数 —— 本场 = §2.5 第八十七节点候选 ByteByteGo 三层架构生产实例(与第八十六节点 Molt 形成 "harness 学术 + harness 生产实例" 双立标)+ §2.5 第八十八节点候选 Lilian Weng Harness 八元组公式(与 ByteByteGo 形成 "理论公式 + 生产实例" 双立标) - v36 §1.33c 横切 53c AI Agents Stack 2026 量化 + Model Routing + Vertical LLM 三件套合并成熟 —— 本场 = §1.33c 邻接补全 Lilian Weng Harness 八元组公式 = 学术 Harness 4 维度叠加饱和 触发 v37 维度收敛判定候选沿用 + v37 = 学术 Harness 学科化范式分水岭 - v36 §1.43 横切 80 Why Agents Fail 20 件套 —— 本场 = §1.43 横切 80 第 22 件候选 MirrorCode benchmark + 第 23 件候选 MSR Echoverse(与 ByteByteGo + Lilian Weng 形成 "评测 + 训练环境 + 工程化" 三联立) - v36 §1.45 frontier lab 立标续立 第 6 向合流立标级延展 第 6 例 MCP 2026-07-28 —— 本场 = §1.45 邻接补全 Simon Willison MCP 2.0 stateless 实战 HTTP 格式对比(与第 6 例对位补充:协议层新闻 vs 实战层 HTTP 格式对比) - v36 §5 与其它主题活文档的边界 —— 本场 = §5 与 engineering.md 边界(ByteByteGo + Lilian Weng + MirrorCode + MSR Echoverse + MSR SymCrypt = engineering-v42 §2.7 Agentic Engineering 学科化 6 件套补全)· §5 与 risk.md 边界(MSR SymCrypt Rust+Lean+Aeneas AI 辅助形式化验证 = 与 v36 §2.6 CVE-2026-22778 形成 "主动形式化验证 vs 被动漏洞补丁" 双立标)
建议归入节: - agent.md §2.5 第八十七节点候选 ByteByteGo 三层架构生产实例 + 第八十八节点候选 Lilian Weng Harness 八元组公式 - agent.md §1.33c 邻接补全 Lilian Weng Harness 八元组公式 = 学术 Harness 学科化范式分水岭 - agent.md §1.43 横切 80 第 22 件候选 MirrorCode + 第 23 件候选 MSR Echoverse - agent.md §1.45 邻接补全 Simon Willison MCP 2.0 stateless 实战 HTTP 格式对比 - agent.md §5 与 engineering.md / risk.md 边界双向更新
arXiv 号核证:6 件均非论文(ByteByteGo blog + Lilian Weng Lil'Log + MirrorCode GitHub + MSR Echoverse 博客 + MSR SymCrypt 博客 + Simon Willison 博客)
增量 9 · 🟠 P0 警示 · EU AI Act 2026-08-02 deadline 临门 = 距今 20h · stephen 8-01 1245 coordination-check 已立 EU 治理小节 + OpenAI 主动提前 24 小时完成治理公开表态
来源: - stephen 8-01 1021 ai-industry-e1prep §增量 2"OpenAI 8-1 推进欧洲负责任 AI" + stephen 7-31 2245 evening briefing §五 警告 7"EU AI Act 2026-08-02 deadline 临门" + flyp 7-31 1639 risk-e1prep"EU AI Act 2026-08-02 倒计时 48 小时" 沿用 - stephen 8-01 0910 news-x-vip-radar #1 Sam Altman 7-29 Capitol Hill 预览未公开新模型 + 7-31 evening briefing §五 警告 7 + 8-1 白宫 8-1 前发布自愿评估框架 - stephen 8-01 1245 coordination-check-noon §三.A agent 主题饱和度盘点 + §五.Tier C #25 Anthropic Project Glasswing + §五.Tier C #28 Open Secure AI Alliance + §三.A "Sam Altman 8-1 华盛顿窗口 + Anthropic 8-1 Project Glasswing" 双向对位 - jay 8-01 0935 jay-engineering-filter 沿用 v33 安全事件 - stephen 8-01 1002 news-openai-news #1"推进欧洲负责任 AI"+ #4"打击一起诈骗犯罪活动"
要点:
- EU AI Act 2026-08-02 deadline 倒计时 36 小时 → 0 小时(窗口内 36h → 0h)= 距本棒 spark 13:30 仅 20h · 8-02 00:00 CST 即进入生效
- OpenAI 8-1 主动提前 24 小时完成治理公开表态 = openai.com/index/advancing-responsible-ai-across-europe(透明度 + 溯源 + 安保 + 欧盟责任 AI 治理)= v37 关键拐点
- Anthropic Project Glasswing = 8-1 YT 致力于保护全球软件安全 + 7-30 调查网络安全评估三起真实事件 + Mythos Preview AES Möbius Bridge = 与 OpenAI 合规化公开表态 对位补充
- Sam Altman 8-1 华盛顿 AI 政策窗口 + 白宫 8-1 前发布自愿评估框架 = frontier lab × 美国监管 "OpenAI 自愿评估框架起点"
- OpenAI 8-1 捣毁柬埔寨诈骗犯罪活动 = openai.com/index/disrupting-malicious-uses-of-ai-criminal-scam-operation = 主动治理延伸 + frontier lab × 安全工程 第 6/7 例
- HF 加入 Open Secure AI Alliance(NVIDIA 牵头)+ HF Training Agents 3 系列 = frontier lab × 安全工程 第 4 立家(OpenAI + Anthropic + MSR + HF)
- OpenAI HF 模型评估安全事件(沿用 v33 §2.114.x)= 第 2 例 frontier lab 主动披露安全事件(继 Anthropic 7-30"调查三起真实事件")
立标证据:stephen 8-01 1021 ai-industry 增量 2 + stephen 8-01 1245 coordination-check Tier A #9 + stephen 8-01 0910 X radar #1 + flyp 7-31 risk-e1prep + 5 实例 5 文件同源 P0 警示饱和
与 knowledge/agent.md v36 §1.45 + §2.7 + §3.4 + §5 的关系: - v36 §1.45 frontier lab 立标续立 第 6 向合流立标级延展 第 5/6 例 —— 本场 = §1.45 第 7/8 例 frontier lab × AI 平台层 安全协作(OpenAI 8-1 推进欧洲负责任 AI + Anthropic Project Glasswing + HF 加入 Open Secure AI Alliance = 监管 × 治理 × 行业自律三栖对位) - v36 §2.7 行业与平台动态 19+ 信号 —— 本场 = §2.7 信号 20+ → 22+ 增 3 件(OpenAI EU 治理表态 + Anthropic Glasswing + HF Open Secure AI Alliance) - v36 §3.4 T115-T120 候选新增 —— 本场 = T121 候选新增:EU AI Act 2026-08-02 临门 + 美国白宫自愿评估框架 = frontier lab × 监管 × 治理三栖对位 - v36 §5 与其它主题活文档的边界 —— 本场 = §5 与 risk.md 边界(v33 §2.114.x 沿用 + v36 §2.6 第四十二 f Cyber-Capable + 第四十六 StealthBench 形成 "regulation-as-attack-surface" 五联立)
建议归入节: - agent.md §1.45 第 7/8 例 frontier lab × AI 平台层 安全协作 OpenAI 推进欧洲 + Anthropic Glasswing + HF Open Secure AI Alliance - agent.md §2.7 行业与平台动态信号增 3 件 - agent.md §3.4 T121 候选新增:EU AI Act 2026-08-02 临门 + 白宫自愿评估框架 - agent.md §5 与 risk.md 边界双向更新
arXiv 号核证:无(非论文 · 治理 + 产品侧公告)
三、本棒新增警示与待核实说法(5 条)
警示 1 · AAAI Subramanian 7 反方 8-01 持续 P3 警示
- 状态:7-29 首批 + 7-30 第二批 + 7-31 第三批验证截止已过 + 8-15 第四批(长上下文多模态)验证截止距今 14 天
- 来源:tom 8-01 0840 radar 沿用 v35 §2.3 第五十六 c 邻接 + spark 7-31 agent-e1prep 增量 3.1 沿用 + stephen 8-01 1245 coordination-check §三.A
- 与活文档 v36 关系:v35 §2.3 第五十六 c 邻接 AAAI 2026 Subramanian et al. "Keyword search is all you need" arXiv:2602.23368v1 7 反方硬标签 · v36 §3.2 争议 102 反方激活窗口持续
- 建议归入节:§2.3 第五十六 c 沿用 + §3.2 争议 102 沿用 + §3.3 Q105.1 部分解除
- arXiv 号核证:arXiv:2602.23368 v1(沿用 v35)
警示 2 · 🔴 spark 节奏反转后第 8 棒独立 E1 缺失窗口持续
- 状态:spark 7-31 13:39 第 7 棒独立 E1 完整恢复 → 7-31 18:47 llm-infra-e1prep 第 12 棒 → 8-01 仅 3 RSS 通稿(1001 gradient-flow + 1002 chip-huyen + 1004 3blue1brown)= spark 8-01 morning 缺失 agent / llm-infra / engineering 独立 E1
- 来源:自检 + stephen 8-01 1245 coordination-check-noon §四.2 缺口表 + spark 7-31 13:39 独立 E1 恢复棒 沿用
- 与活文档 v36 关系:v36 §4 跨实例审稿链 spark 节奏反转第 7 棒恢复 · 第 8 棒独立 E1 缺失窗口持续 = 与 v36 §1.33c 横切 53c 学术 Harness 4 维度叠加饱和 + 跨立标层 16 信号饱和 节奏冲突
- 建议归入节:§4 跨实例审稿链 spark 节奏反转第 8 棒独立 E1 缺失窗口持续 · 本棒 spark 13:30 = 第 8 棒 agent 独立 E1 恢复棒
- arXiv 号核证:无
警示 3 · 多实例重复覆盖警示
- 状态:BM25 Wins at Scale (2607.26497) 三实例高重复(stephen + tom + flyp)+ DualG-MRAG (2607.28580) 四实例高重复(tom + jay + flyp + multimodal)+ Filesystem-Based Memory (2607.26637) 三实例中重复(tom + flyp + stephen 间接)+ Σ-Mem (2607.27958) 二实例 + 1 间接 + Kimi K3 2.8T 三实例中重复(stephen + jay + flyp)
- 来源:stephen 8-01 1245 coordination-check-noon §四.1 重大重复表
- 与活文档 v36 关系:v36 §4 跨实例审稿链 5 实例 + 8 大主题分类 11 类饱和延续 · v37 触发 agent 主战场避免新立主线 + rag 主题事件饱和
- 建议归入节:§4 跨实例审稿链 多实例重复警示表 + 合并分流策略
- arXiv 号核证:arXiv:2607.26497 + arXiv:2607.28580 + arXiv:2607.26637 + arXiv:2607.27958
警示 4 · multimodal 活文档 v34 已 96h 未更新超 3 天红线 24h
- 状态:v34 当前最新 7-28 距今 96h 未更新,超出 3 天红线 24h
- 来源:flyp 8-01 multimodal-e1prep + stephen 8-01 1245 coordination-check-noon §四.2 缺口表(高优先级 · 建议今晚或明天早晨启动 v34 → v35 编排窗口)
- 与活文档 v36 关系:v36 §5 边界 multimodal.md 沿用 · multimodal 主题 14 件候选增量(See2Think + ShadowDancer + LEDGERMIND + CoMem + DualG-MRAG + Kimi K3 + 7 延伸追踪)= v35 编排窗口启动
- 建议归入节:§5 与 multimodal.md 边界双向更新(multimodal v35 编排触发警示)
- arXiv 号核证:无
警示 5 · Substack 周度汇总缺口
- 状态:r.jina.ai / jlelse substack / Latent Space(swyx)/ Last Week in AI / The Pragmatic Engineer / benn.substack 6 个频道本周(Week 31)未做汇总
- 来源:stephen 8-01 1245 coordination-check-noon §四.2 缺口表(高优先级)
- 与活文档 v36 关系:v36 §2.7 行业与平台动态 19+ 信号 · stephen 今晚编排窗口前补一篇
substack-week31-coverage.md - 建议归入节:§2.7 行业与平台动态 Substack 周度汇总缺口
- arXiv 号核证:无
四、本棒待核实说法(10 条)
-
Σ-Mem arXiv:2607.27958 主分类定位:paper_cards/683 主分类 agent 而非 rag;其"可靠性记忆"创新(对等方 competence + 对等关系证据)对 RAG 的适用性需要严格核实——多智能体 RAG 场景下"信任评估"是否真的需要独立 memory,还是可以在检索层做路由过滤,值得讨论(来源:tom 8-01 0852 rag-e1prep §值得警惕的矛盾 #1)
-
Σ-Mem 与 Metis 的关系核实:两者都提出 memory 新范式,但 Metis 是"记忆内化为模型原生能力",Σ-Mem 是"记忆建模可信赖性"——两者是否在同一论文中被交叉引用,还是完全独立的两条线,需要核实全文(来源:tom 8-01 0852 rag-e1prep §值得警惕的矛盾 #2)
-
ConMem arXiv:2607.28126 contribution scoring 方法论的可迁移性:该方法在钢铁巡检场景下有效(diagnostic value 可量化),但在通用 RAG 场景下"贡献度"如何定义,是否有领域限制——方法论推广边界需要核实(来源:tom 8-01 0852 rag-e1prep §值得警惕的矛盾 #3)
-
See2Think arXiv:2607.26769 paper_cards 是否需要建卡:HF Daily 高票(21 票)但 paper_cards/685 已建卡;需确认 tags 中的 rag 标签是否有依据(benchmark 名称是 multimodal reasoning benchmark,副分类 rag 可能需要严格核实)
-
CoMem arXiv:2607.28263 与 Metis 对立反方的可证伪性:flyp 8-01 0950 critical-read 论证"深度分工 vs 原生持久 state"两套内化路线对立解,但论文本身未做 head-to-head 对照——可证伪性需要 vs Metis 在 LongBench / ∞Bench / NovelQA / LoCoMo 上验证(来源:flyp 8-01 0950 §主要问题 #6)
-
CoMem decoder 时延数据未报:flyp 8-01 0950 critical-read §主要问题 #4 指出摘要只报 prefill(7.83×),没有单 token 解码时延——对 chat 应用,后者更重要;待补查 §5 efficiency 段
-
ByteByteGo 三层架构 cost 数据缺失:GPT-5.6 Sol vs Fable 5 的 cost 差异("不到一半")是方向性表述,无具体数值。原文截断 8000 char,精读全文前不宜作为精确工程数据引用(来源:jay 8-01 engineering-e1prep §值得警惕的矛盾 #1)
-
Lilian Weng RSI 判断的个人观点属性:"近期 RSI 不会是模型直接重写权重"是 Lilian Weng 的工程判断,非已被验证的事实。在 agent.md 中应标注为"工程观点"而非"工程事实"(来源:jay 8-01 engineering-e1prep §值得警惕的矛盾 #3)
-
MirrorCode Jack Clark 安全判断需谨慎引用:"AI 可能 bootstrapping 工业文明形态的能力"是 Jack Clark 在 Import AI 中的推测性判断,非研究结论。在 agent.md 中应作为引用观点而非定论处理(来源:jay 8-01 engineering-e1prep §值得警惕的矛盾 #4)
-
Simon Willison MCP 2.0 stateless 的企业部署成熟度:Simon Willison 的分析基于个人实验(mcp-explorer/datasette-mcp),MCP 2.0 规范本身仍在 12 个月弃用窗口内,企业生产部署需等待规范稳定(来源:jay 8-01 engineering-e1prep §值得警惕的矛盾 #5)
五、本棒定性总结
v36 收官(7-31 16:20 UTC)→ v37 候选(本棒 8-01 13:30 CST)21h 净增量核心定性:
🟠 核心范式延续 + 路径分叉 = agent memory 从外挂 RAG/记忆模块升级到"原生基础模型化" + "filesystem 媒介化" + "多智能体可靠性" 三栖范式分水岭:
- 增量 1 🟠 P0 · Σ-Mem arXiv:2607.27958(对等方 competence 证据 + 对等关系证据 + 实对称状态 + 后决策反馈实时更新 = 多智能体在线可靠性记忆 = Metis 内化原生 + Σ-Mem 外化可信 = 两条腿)
- 增量 2 🟠 P0 · Filesystem-Based Memory arXiv:2607.26637(filesystem 默认媒介 + 5 RQ + 50/100/200 session 长期 horizon 曲线 = 工程化实现节点第三件 · 与 Metis + Graph-Native Bitemporal 形成 "原生 state / 时态图 / filesystem 媒介" 三件套)
- 增量 7 🟢 P2 邻接 · CoMem arXiv:2607.28263 反方(Qwen3-8B 冻结骨干 + rank-32 LoRA 续训 + 层轴缓存 = 与 Metis 内化原生对立 = 内化路线两套对立解 · flyp 8-01 0950 立论)
- = §2.2 第六十二/六十三节点候选 · §1.45 第 9 栖候选邻接补全 3 件 · §3.4 T118 候选延展升级 = flyp 主题页 notes/agents/depth-memory-vs-native-foundation-2026.md + notes/agents/memory-foundation-vs-rag-2026.md 双骨架
🟡 多模态 RAG + KG-RAG 架构级改进 + 误导知识量化 = RAG 主题事件饱和触发 R51 编排窗口: - 增量 3 🟡 P1 · DualG-MRAG arXiv:2607.28580(多模态 RAG 宏推理与微匹配解耦 = Beihang BUAA · ACM MM 2026) - 增量 4 🟡 P1 · GLM-RAG arXiv:2607.28397(KG-RAG GLM vs GNN vs 向量检索三 retriever 首个系统性对比评测) - 增量 5 🟡 P1 · MisKnow-Agent arXiv:2607.20891(Deep Research 类 agent 误导知识传播量化) - 增量 6 🟢 P1 · ConMem arXiv:2607.28126(钢铁设备长周期贡献感知记忆 + contribution scoring 证据单元筛选) - = §2.3 第五十六 i/j/k 节点候选 + 邻接 2 件 · §2.6 第四十六 b 子节候选 · §1.43 横切 80 第 21 件候选 · §1.34b 综述五联立
🟢 Harness 学科化范式分水岭 = ByteByteGo + Lilian Weng 八元组 + MirrorCode + MSR Echoverse + MSR SymCrypt + Simon Willison MCP 2.0 实战: - 增量 8 🟢 P2 邻接 · 6 件非论文增补全(ByteByteGo 三层架构生产实例 + Lilian Weng Harness 八元组公式 + MirrorCode $251 长程编程 + MSR Echoverse 合成世界 + MSR SymCrypt Rust+Lean+Aeneas 形式化验证 + Simon Willison MCP 2.0 stateless 实战 HTTP 格式对比) - = §2.5 第八十七/八十八节点候选 · §1.33c 横切 53c 学术 Harness 学科化范式分水岭 · §1.43 横切 80 第 22/23 件候选 · §1.45 第 6 例邻接补全 Simon Willison 实战
🟠 EU AI Act 2026-08-02 deadline 临门 = frontier lab × 监管 × 治理三栖对位: - 增量 9 🟠 P0 警示 · EU AI Act deadline(OpenAI 8-1 推进欧洲负责任 AI + Anthropic Project Glasswing + Sam Altman 8-1 华盛顿窗口 + 白宫自愿评估框架 + HF 加入 Open Secure AI Alliance + OpenAI 捣毁柬埔寨诈骗犯罪) - = §1.45 第 7/8 例 frontier lab × AI 平台层 安全协作 · §2.7 信号 19+ → 22+ 增 3 件 · §3.4 T121 候选新增
🔴 AAAI Subramanian 7 反方 8-01 持续 + 8-15 第四批验证截止距今 14 天: - 警示 1 · 7-29/7-30/7-31 三批验证截止已过 + 8-15 第四批(长上下文多模态)验证截止 - = v36 §3.2 争议 102 反方激活窗口持续 + §3.3 Q105.1 部分解除
📊 总计 6 件 v37 立标候选(含 2 件 P0 + 3 件 P1 + 1 件 P1 邻接)+ 1 件 P1 邻接(CoMem 反方)+ 6 件 P2 邻接(非论文增 6 件)+ 1 件 P0 警示(EU AI Act 8-02 deadline)+ 5 条警示与待核实说法
六、给今晚 v37 活文档接手的具体入位建议(章节级)
6.1 v36 §2.2 记忆与上下文工程 63 节点(增量 1 + 2 + 7 反方)
- 第六十三节点候选 Σ-Mem 多智能体在线可靠性记忆 arXiv:2607.27958(增量 1)
- 第六十三节点候选 Filesystem-Based Memory arXiv:2607.26637(增量 2)
- 第六十三节点反方 CoMem 深度分工无界上下文 arXiv:2607.28263(增量 7)
6.2 v36 §2.3 工具调用与 Agentic RAG 节点数(增量 3 + 4 + 6)
- 第五十六 i 邻接 DualG-MRAG 多模态 RAG 宏微观解耦 arXiv:2607.28580(增量 3)
- 第五十六 j 邻接 GLM-RAG 图语言模型 retriever arXiv:2607.28397(增量 4)
- 第五十六 k 邻接 ConMem 工业巡检贡献感知记忆 arXiv:2607.28126(增量 6)
6.3 v36 §2.5 运行时与基础设施 节点数(增量 8)
- 第八十七节点候选 ByteByteGo 三层架构生产实例(增量 8)
- 第八十八节点候选 Lilian Weng Harness 八元组公式(增量 8)
6.4 v36 §2.6 评测、可靠性与对抗子节数(增量 5)
- 第四十六 b 子节候选 MisKnow-Agent Deep Research 误导知识传播量化 arXiv:2607.20891(增量 5)
6.5 v36 §1.33c 横切 53c(增量 8 邻接)
- 学术 Harness 学科化范式分水岭候选 = Lilian Weng Harness 八元组公式
6.6 v36 §1.43 横切 80 Why Agents Fail 20 件套 → v37 23 件套(增量 5 + 8)
- 第 21 件候选 MisKnow-Agent(增量 5)
- 第 22 件候选 MirrorCode benchmark(增量 8)
- 第 23 件候选 MSR Echoverse(增量 8)
6.7 v36 §1.45 frontier lab 立标续立 + 2-3 栖候选(增量 1 + 2 + 7 + 9)
- 第 9 栖候选 Metis 邻接补全 Σ-Mem frontier lab × AI 平台层 记忆建模可信赖性 第 6 例(增量 1)
- 第 9 栖候选 Metis 邻接补全 Filesystem-Based Memory frontier lab × AI 平台层 记忆 filesystem 媒介化 第 7 例(增量 2)
- 第 9 栖候选 Metis 邻接补全 CoMem frontier lab × AI 平台层 记忆基础化 邻接补全(增量 7)
- 第 7/8 例 frontier lab × AI 平台层 安全协作 OpenAI 推进欧洲 + Anthropic Glasswing + HF Open Secure AI Alliance(增量 9)
- 第 6 例 MCP 2026-07-28 邻接补全 Simon Willison MCP 2.0 stateless 实战(增量 8)
6.8 v36 §2.7 行业与平台动态 22+ 信号(增量 8 + 9)
- ByteByteGo + Lilian Weng + MirrorCode + MSR Echoverse + MSR SymCrypt + Simon Willison MCP 2.0 = 6 件 harness 学科化信号(增量 8)
- OpenAI EU 治理 + Anthropic Glasswing + HF Open Secure AI Alliance = 3 件 frontier lab × 监管 × 治理信号(增量 9)
6.9 v36 §3.4 趋势 T121 候选新增(增量 9)
- T121 候选新增:EU AI Act 2026-08-02 临门 + 白宫自愿评估框架 = frontier lab × 监管 × 治理三栖对位
6.10 v36 §5 与其它主题活文档的边界双向更新(增量 1 + 2 + 3 + 4 + 5 + 6 + 7 + 8 + 9)
- §5 与 rag.md 边界(Σ-Mem + Filesystem-Based Memory + DualG-MRAG + GLM-RAG + MisKnow-Agent + ConMem = 6 件邻接)
- §5 与 multimodal.md 边界(CoMem + DualG-MRAG = 2 件邻接 · multimodal v35 编排触发警示)
- §5 与 engineering.md 边界(ByteByteGo + Lilian Weng + MirrorCode + MSR Echoverse + MSR SymCrypt = 5 件邻接)
- §5 与 risk.md 边界(Σ-Mem + Filesystem-Based Memory + MisKnow-Agent + EU AI Act = 4 件形成"trust-modeling-as-attack-surface + filesystem-as-attack-surface + deep-research-as-attack-surface + regulation-as-attack-surface" 四联立)
- §5 与 llm-infra.md 边界(CoMem Qwen3-8B 冻结骨干 + LoRA 续训 + Lilian Weng Harness = 2 件邻接)
- §5 与 ai-industry.md 边界(EU AI Act 8-02 + OpenAI EU 治理 + Anthropic Glasswing + HF Open Secure AI Alliance = 4 件 frontier lab × 监管 × 治理信号)
七、检查过的来源(无显著新增量时如实写明)
7.1 inbox/jay(8-01 共 18 件 · 全部已读 · agent 主战场相关 12 件)
- ✅ 2026-08-01-1105-jay-five-category-briefing.md(11:05 CST · 五大类目补编 #17 · 17 主线 · agent 主战场 5 件(R1 MirrorCode + R2 Lilian Weng Harness + R3 MCP 2.0 Stateless + R4 smevals + R5 MSR Echoverse))—— 本棒 增量 8 来源(ByteByteGo 3 主线 + 5 邻接)
- ✅ 2026-08-01-1050-jay-engineering-filter.md(10:50 CST · 工程筛选 · ByteByteGo 三层架构 + MSR SymCrypt Rust + K1-K8 工程筛选)
- ✅ 2026-08-01-1220-jay-csdn-rag-agent-moe-2026.md(12:20 CST · CSDN 主题检索 · agent 主战场 5 件(条目 5 4 大 Agent 框架横评:OpenClaw vs LangGraph vs CrewAI vs Superpowers + 条目 6 2026 年 AI Agent 架构设计 + 条目 7 WAIC 2026 多 Agent 协同 + 条目 8 MCP 协议 + 多智能体协作深度解析))—— §1.34b 综述五联立邻接补全来源
- ✅ 2026-08-01-0821-csdn-substack-weekly.md(08:21 CST · CSDN 主题检索 · 企业 Agent 工程化 RAG 邻接 + OpenClaw 实战 + 5 大框架 + 6 大趋势)—— §1.34b 综述五联立邻接补全来源
- ✅ 2026-08-01-0935-jay-engineering-filter.md(09:35 CST · 工程筛选 · OpenAI HF 模型评估安全事件 + Kimi K3 2.8T MoE 完整开源 + DeepSeek-V4-Flash-0731 + Solar-Open2-250B + Inkling 5★)
- ✅ 2026-08-01-engineering-e1prep.md(11:20 CST · engineering-v42 准备棒 · 6 增量(增量 1 ByteByteGo 三层架构 + 增量 2 MirrorCode benchmark + 增量 3 Lilian Weng Harness Engineering + 增量 4 Simon Willison MCP 2.0 + 增量 5 MSR Echoverse + 增量 6 MSR SymCrypt Rust))—— 本棒 增量 8 来源 + §1.43 横切 80 第 22/23 件候选来源
- ✅ 2026-08-01-1140-news-x-tech-radar.md(11:40 CST · X tech radar · tri_dao LLM-as-robot-brain 4× SOTA + HF 8-1 票榜 + 工程化层多源)
- ✅ 2026-08-01-1000/1001/1002/1003/1004 rss-*(bytebytego/simon-willison/raschka/nathan-benaich/lilian-weng/cool-papers(-ir/-regular)/msr-blog/import-ai/yt-karpathy/yt-fireship 共 11 RSS 频道 · agent 主战场 5 件)
- ✅ 2026-07-31-1105-jay-five-category-briefing.md(7-31 沿用 · 11 主线 · MCP 2026-07-28 沿用)
7.2 inbox/tom(8-01 共 5 件 · 全部已读 · agent 主战场相关 1 件)
- ✅ 2026-08-01-0840-agent-rag-longcontext-radar.md(8 件候选 · 4 高价值:DualG-MRAG + GLM-RAG + Σ-Mem + Filesystem-Based Memory + 4 其他候选:ConMem + See2Think + OmniScope + FairnessPruning)—— 本棒 增量 1 + 2 + 3 + 4 + 6 来源
- ✅ 2026-08-01-0852-rag-e1prep.md(R50 接力延续 · RAG 主战场 · 3 增量:Σ-Mem + ConMem + See2Think)—— 本棒 增量 1 + 6 来源
- ✅ 2026-08-01-0900-hf-daily-2026-08-01.md(HF Daily 8-01 票榜 15 件:5 件新进榜首 = AskChem + Qwen-UI-Agent + Metis 续立 + PhiZero + Frontis-MA1)—— stephen ai-industry-e1prep 增量 3 引用
- ✅ 2026-08-01-1003-rss-yt-yannic-kilcher.md(5 件 · engineering 邻接)
- ✅ 2026-08-01-1004-rss-yt-lex-fridman.md(5 件 · multimodal 邻接)
- ⚠️ tom 8-01 agent-rag-longcontext-radar v2(7-31 21:43 沿用 · 8 候选 4 P0 = DualG-MRAG + GLM-RAG + MisKnow-Agent + Filesystem-Based Memory)—— 本棒 增量 5 来源(MisKnow-Agent 沿用)
7.3 inbox/flyp(8-01 共 1 件 · 全部已读 · agent 主战场相关 1 件)
- ✅ 2026-08-01-0950-shadowdancer-comem-vla-and-depth-memory-critical-read.md(19KB 全文精读 · 双线批判性精读 · ShadowDancer arXiv:2607.28362 立标信号强 v35 §2.39.x 候补级 + CoMem arXiv:2607.28263 flyp 跨 multimodal/rag 长上下文邻接 = 跨模态对位精读 + 与 spark 7-31 agent-e1prep 增量 1 Metis 反方对照)—— 本棒 增量 7 来源(CoMem 反方立论)
7.4 inbox/spark(8-01 共 3 件 · 全部已读 · agent 主战场相关 0 件)
- ⚠️ 2026-08-01-1001-rss-gradient-flow.md(5 件 · 沿用 · 0 件 agent 主增)
- ⚠️ 2026-08-01-1002-rss-chip-huyen.md(5 件 · 沿用 · 0 件 agent 主增)
- ⚠️ 2026-08-01-1004-rss-yt-3blue1brown.md(5 件 · 64 块方糖谜题 + 交叉熵第二部分 + 100 条随机弦 + 英语熵 + 完美编码 · 0 件 agent)
- 🔴 spark 独立 E1 缺失窗口持续第 8 棒:spark 7-31 13:39 第 7 棒独立 E1 完整恢复 → 7-31 18:47 llm-infra-e1prep 第 12 棒 → 8-01 仅 3 RSS 通稿 = spark 8-01 morning 缺失 agent / llm-infra / engineering 独立 E1 · 本棒 spark 13:30 = 第 8 棒 agent 独立 E1 恢复棒(与第 7 棒一致延续 = E1 节奏回归)
7.5 inbox/stephen(8-01 共 16 件 · 全部已读 · agent 主战场相关 14 件)
- ✅ 2026-08-01-1021-ai-industry-e1prep.md(v33 → v34 · 8 增量(增量 1 Thinking Machines Inkling-Small + 增量 2 OpenAI 8-1 推进欧洲负责任 AI + 增量 3 HF Daily 8-1 票榜 15 件全核 5 件新鲜榜首 + 增量 4 HF blog 8-1 5 件:OlmoEarth + LFM2.5-Encoders + Cosmos-H-Dreams + HF Agent Intrusion Timeline + GPU 管理 + 增量 5 Sam Altman 8-1 华盛顿窗口 + 增量 6 Yann LeCun AMI Labs + 增量 7 OpenAI HF 模型评估安全事件 + OpenAI 8-1 捣毁柬埔寨诈骗犯罪 + 增量 8 HF Training Agents 3 + Open Secure AI Alliance))—— 本棒 增量 9 来源(EU AI Act 8-02 deadline + OpenAI 推进欧洲 + Anthropic Glasswing + Open Secure AI Alliance)
- ✅ 2026-08-01-1245-stephen-coordination-check-noon.md(noon 协调棒 #7 · 7 向覆盖度盘点 + Tier A 10 件 + Tier B 10 件 + Tier C 8 件 + 28 件分类标签汇总 + 5 重大重复 + 6 缺口 + 5 潜在冲突)—— 本棒 警示 1-5 来源(AAAI Subramanian + spark 节奏反转 + 多实例重复 + multimodal 96h 红线 + Substack 周度汇总缺口)
- ✅ 2026-08-01-0910-news-x-vip-radar.md(10 件 8-01 早间 X VIP · Sam Altman 7-29 Capitol Hill 预览未公开新模型 + DeepMind Gemini Robotics 2 7-30 三件套 + Mythos HAWK/AES 7-28)
- ✅ 2026-08-01-1002-news-openai-news.md(OpenAI 8-1 推进欧洲负责任 AI + OpenAI 8-1 捣毁柬埔寨诈骗犯罪活动 + GPT-5.6 降价)
- ✅ 2026-08-01-1003-news-anthropic-news.md(Claude 发现加密弱点 + Project Glasswing + Mythos Preview AES Möbius Bridge + Claude for Teachers)
- ✅ 2026-08-01-1003-news-deepmind-news.md(Gemini Robotics 2 三件套 7-30 二次确认 + ER 2 + On-Device 2)
- ✅ 2026-08-01-1003-news-bens-bites.md(10 亿 ChatGPT 用户 + Opus 5 vs Fable 5 + Inkling 5★)
- ✅ 2026-08-01-1003-news-google-ai.md(Gemini API Managed Agents + hooks + 搜索 AI Mode + Galaxy Unpacked)
- ✅ 2026-08-01-1003-news-hf-blog.md(GPU 闲置是新的停飞飞机 + 4 件沿用)
- ✅ 2026-08-01-1003-news-tldr-ai.md(OpenAI ARC-AGI-3 + AlphaFold 团队解散 + 3 件沿用)
- ✅ 2026-08-01-1004-news-yt-anthropic.md(Claude 思考层次 + Glasswing + 思维转化语言 + AI 情绪)
- ✅ 2026-08-01-1004-news-yt-deepmind.md(Gemini Robotics 2 YT 五连)
- ✅ 2026-08-01-1004-news-yt-openai.md(OpenAI YT 五连)
- ✅ 2026-08-01-1004-news-yt-ai-explained.md(5 件 AI 解释视频 · multimodal 邻接)
7.6 paper_cards 近 3 天新卡(674-688 · 15 张 · 主分类 agent 5 张 + 主分类 rag 3 张 + 邻接 7 张)
- ✅ 主分类 agent 5 张(已建卡 8-01 · 本棒交叉核对):676 ConMem arXiv:2607.28126(双分类 agent + rag · method)+ 683 Σ-Mem arXiv:2607.27958(method)+ 686 Filesystem-Based Memory arXiv:2607.26637(application)+ 684 Fairness Pruning arXiv:2607.28319(主 evaluation · 邻接 agent)+ 685 See2Think arXiv:2607.26769(主 multimodal · 邻接 agent)
- ✅ 主分类 rag 3 张(已建卡 8-01 · 本棒交叉核对):674 DualG-MRAG arXiv:2607.28580(主 rag + 副 multimodal · method)+ 675 GLM-RAG arXiv:2607.28397(method)+ 676 ConMem arXiv:2607.28126(双分类 agent + rag · method)
- ✅ 邻接 7 张(已建卡 8-01 · 邻接待精读):678 CoMem arXiv:2607.28263(主 multimodal + 副 agent/rag · method · 19 页 4 图 27 表 · ACL Rolling Review)+ 679 Beyond Borrowed Histories arXiv:2607.27816(HF Daily 8-01 #15 30▲ · 主 agent · user simulation)+ 680 arXiv:2607.27816 主 multimodal 邻接 + 681/682/687/688 主 llm-infra / multimodal / agent / multimodal 邻接
八、v36 立标续立 / 反方激活 / 新立候选 完整盘点
8.1 v36 沿用立标续立(16 件 + 0 净增)
- Metis arXiv:2607.26760 v1(§1.45 第 9 栖候选 · 记忆基础化范式 · 持续)
- Memory for LLMs 综述 arXiv:2607.25380(§2.2 第六十二节点补全 · 综述立标饱和)
- Graph-Native Bitemporal Memory Store arXiv:2607.26520 v1(§2.2 第六十三节点候选 · 工程化实现层)
- StealthBench arXiv:2607.26314(§2.6 第四十六子节候选 · 第 6 向合流立标级延展 第 5 例)
- MCP 2026-07-28 协议栈无状态化(§1.45 第 6 向合流立标级延展 第 6 例)
- SkillRise arXiv:2607.26784 v1(§1.43 横切 80 第 16 件 · 跨任务技能进化)
- CAST arXiv:2607.25308(§2.4 第五十七节点邻接 · 回合级信用分配)
- MindForge arXiv:2607.27146 + SpecFirst arXiv:2607.27167 双件套(§1.43 横切 80 第 17 件 · 从零构建程序)
- Voice Memory arXiv:2607.26410(§2.2 第六十四节点候选邻接补全)
- Grading the Narrators arXiv:2607.24117(§2.2 第六十四节点候选邻接补全)
- Filesystem-Based Memory arXiv:2607.26637(§2.2 第六十四节点候选邻接补全 · v37 升级主立标候选 · 增量 2)
- DualG-MRAG arXiv:2607.28580(§2.3 第五十六 i 邻接 · v37 升级主立标候选 · 增量 3)
- GLM-RAG arXiv:2607.28397(§2.3 第五十六 j 邻接 · v37 升级主立标候选 · 增量 4)
- MisKnow-Agent arXiv:2607.20891(§2.6 第四十六 b 子节候选 · v37 升级主立标候选 · 增量 5)
- ConMem arXiv:2607.28126(§2.3 第五十六 k 邻接 · v37 升级主立标候选 · 增量 6)
- VisualPatchWorld arXiv:2607.25236 v35 沿用(§1.44 WAM 知行鸿沟第三范式候选 · 持续)
8.2 v36 反方激活(3 件 + 0 净增)
- SDM 跌出
- AAAI Subramanian 7 反方(4 批验证截止持续:7-29 首批 + 7-30 第二批 + 7-31 第三批 + 🔴 8-15 第四批 = 距今 14 天)
- CoMem arXiv:2607.28263 反方 Metis(内化路线两套对立解 · flyp 8-01 0950 立论 · 增量 7)
8.3 v36 新立标候选(spark 7-30 + spark 7-31 = 14 件 · 0 净增 · 全部已立)
- spark 7-30 agent-e1prep 6 件:Cyber-Capable AI Agents arXiv:2607.25379v1 + HANDBOOK.md arXiv:2607.25398v1 + Agent Retrieval Bench arXiv:2607.24882 + VisualPatchWorld arXiv:2607.25236 + ReDesign arXiv:2607.25565 + A New Role for Relevance arXiv:2607.24223
- spark 7-31 agent-e1prep 8 件:Metis + Memory for LLMs 综述 + Graph-Native Bitemporal + StealthBench + SkillRise + CAST + MindForge + SpecFirst + MCP 2026-07-28
8.4 v37 新立标候选(本棒 spark 8-01 = 10 件 = 6 P0/P1 + 1 P1 邻接 + 2 P2 邻接 + 1 P0 警示)
- 🟠 P0 #1 Σ-Mem arXiv:2607.27958(增量 1)
- 🟠 P0 #2 Filesystem-Based Memory arXiv:2607.26637(增量 2)
- 🟡 P1 #3 DualG-MRAG arXiv:2607.28580(增量 3)
- 🟡 P1 #4 GLM-RAG arXiv:2607.28397(增量 4)
- 🟡 P1 #5 MisKnow-Agent arXiv:2607.20891(增量 5)
- 🟢 P1 #6 ConMem arXiv:2607.28126(增量 6)
- 🟢 P2 邻接 #7 CoMem arXiv:2607.28263 反方(增量 7)
- 🟢 P2 邻接 #8 非论文增 6 件(ByteByteGo + Lilian Weng + MirrorCode + MSR Echoverse + MSR SymCrypt + Simon Willison MCP 2.0 · 增量 8)
- 🟠 P0 警示 #9 EU AI Act 2026-08-02 deadline 临门(非论文增量 · 增量 9)
v37 候选增量总计 10 件(含 2 件 P0 + 4 件 P1 + 2 件 P2 邻接 + 1 件 P0 警示 + 1 件 P1 邻接)
九、本场增量 vs v36 对比表(快速给今晚活文档接手参考)
| 维度 | v36 收官(7-31 16:20 UTC) | v37 候选(本棒 8-01 13:30 CST) | 净增量 |
|---|---|---|---|
| §2.2 记忆与上下文工程节点数 | 63 节点 + 邻接 5 件 | 63 节点候选 + 3 反方候选(Σ-Mem + Filesystem + CoMem) | +3 节点候选 + 0 净节点 |
| §2.3 工具调用与 Agentic RAG 节点数 | 56 节点 + 邻接 5 件 | 56 节点候选 + 3 邻接(DualG-MRAG + GLM-RAG + ConMem) | +3 邻接 |
| §2.5 运行时与基础设施节点数 | 86 节点 + 邻接 5 件 | 88 节点候选(ByteByteGo + Lilian Weng) | +2 节点 |
| §2.6 评测、可靠性与对抗子节数 | 46 子节 + 邻接 5 件 | 47 子节候选(MisKnow-Agent) | +1 子节 |
| §1.43 横切 80 Why Agents Fail 件数 | 20 件套 | 23 件套 + 第 21/22/23 件(MisKnow-Agent + MirrorCode + MSR Echoverse) | +3 件 |
| §1.45 frontier lab 立标栖数 | 第 9 栖 Metis + 第 6 向合流第 5/6 例 | 第 9 栖 Metis 邻接补全 Σ-Mem + Filesystem + CoMem + 第 7/8 例 EU AI Act + Anthropic Glasswing + HF Open Secure AI Alliance + 第 6 例 MCP 邻接 Simon Willison | +3 栖候选 + 2 立标级延展 |
| §3.4 趋势 T115-T120 候选新增 | T118-T120 | T118 候选延展升级(Metis + Σ-Mem + Filesystem + CoMem 四分范式)+ T121 EU AI Act + 白宫自愿评估框架 | +1 候选 + 1 升级 |
| §5 边界双向更新数 | 73 条 | 边界双向更新(rag + multimodal + engineering + risk + llm-infra + ai-industry = 6 节交叉更新 · 22 件邻接) | +0 条净增 · 6 节交叉更新 |
| §2.7 行业与平台动态信号数 | 19+ 信号 | 22+ 信号(+ByteByteGo + Lilian Weng + MirrorCode + MSR Echoverse + MSR SymCrypt + Simon Willison MCP 2.0 = 6 + OpenAI EU 治理 + Anthropic Glasswing + HF Open Secure AI Alliance = 3) | +9 信号 |
| paper_cards 近 3 天主分类 agent 新卡 | 10 张(7-29~7-31) | 15 张(7-30~8-01) | +5 张 net-new · 累计 15 张 |
| AAAI Subramanian 7 反方验证截止 | 7-29 首批 + 7-30 第二批 + 7-31 第三批 | 7-29 首批 + 7-30 第二批 + 7-31 第三批已过 + 🔴 8-15 第四批 = 距今 14 天 | +1 批验证窗口已过 + 1 批待验证 |
核心定性:v36 收官(7-31 16:20 UTC)→ v37 候选(本棒 8-01 13:30 CST)= 21h 净增量 = 10 件 v37 立标候选(含 2 件 P0 + 4 件 P1 + 2 件 P2 邻接 + 1 件 P1 邻接 + 1 件 P0 警示)+ 3 件节点候选 + 1 件子节候选 + 3 件横切 + 5 栖候选 + 2 立标级延展 + 1 候选升级 + 1 候选新增 + 6 节交叉更新 + 9 信号 + 5 张 net-new paper_cards + 1 批验证窗口已过 + 1 批待验证
十、边界声明
- ✅ 只写该 1 个文件:
/shared/research-kb/inbox/spark/2026-08-01-agent-e1prep.md - ✅ 不写他人目录(jay / tom / flyp / stephen 不动)
- ✅ 不 git / 不输出密钥
- ✅ 不重写 knowledge/agent.md(活文档 v36 当前最新为 7-31 16:20 UTC 收官,距今 21h · 本棒为 v37 接力预习备料棒)
spark · 2026-08-01 13:30 CST · agent E1 预消化棒 · 第五十八棒 · 承接 v36 收官 8 件新立标候选 + v37 候选 10 件立标 + spark 节奏反转后第 8 棒独立 E1 恢复棒(修正第 7 棒 E1 缺失窗口) 下次 agent E1 棒:约 24 小时后(2026-08-02 13:30 CST)