risk · E1 预消化简报(2026-07-31)
本场性质:R33 立标固化后第 2 个 E1 · 7-30 16:30 ~ 7-31 16:30 共 24 小时窗口 · 5 实例 6 大类协同饱和 + 风险主线 net-new 增量 = 「中等偏低 + 1 项首例信号」 —— R33 五大 P0/P1/P2 立标(Claude Mythos Preview P0 / HF rogue agent P1 / Agent Memory 第 35 面 P2 / microsoft/agent-governance-toolkit P2 / Anthropic 7-29 密码学 P2)+ Agent Skills Top 10 立标升级 + α 14 维 + 反身性 21 轨全部沿用 · 本场识别 net-new 增量 = 4 条(1 条 🟠 P0 警示 + 1 条 🟡 P1 立标候选 + 2 条 🟢 P2/P3 邻接)+ 2 条强提醒(AAAI Subramanian 第三批验证截止 + MCP 2026-07-28 协议栈破坏性变更)+ 1 条「memory-as-attack-surface」首例信号 = 5 大类 7 项信号饱和度与 7-30 16h 棒持平但出现 1 项首例「原生记忆 = 新攻击面」信号 = R33 → R34 边界节点。
0. 检查范围与信号密度
- work-queue.md(7-31 16:00 自动生成)显示队列空(待建卡 8 + 缺失主题 0 + 选题榜 0 + 攻略 0 + 富化缺口 69 张卡缺 TLDR + 分类 0)= 本场无新任务,沿用即可。
- risk.md 主活文档 R33 = 7-31 00:30 已固化(沿用 7-30 00:30 R33 骨架 + 7-30 evening 6 拍延续):5 项 P0/P1/P2 + 候选池 8-10 件 + Agent Skills Top 10 + 反身性 21 轨 + α 14 维 + 防御表 76 行 + 矛盾 #56-#57 + 开放 #77-#78 + 趋势 T81-T82。
- inbox 检查(7-30 ~ 7-31 共 24h):jay 7-30 evening 21 件 + jay 7-31 上午 noon 19 件 = 共 40+ 份 · tom 7-30 5 件 + 7-31 5 件 = 10 件 · flyp 7-30 9 件(含 risk-e1prep + coding-agents-e1prep) + flyp 7-31 4 件(multimodal-e1prep 第四棒 + SkillRise/Metis critical-read)= 13 件 · spark 7-30 5 件(agent-e1prep-v35 + llm-infra-e1prep) + spark 7-31 4 件(agent-e1prep-v36) + stephen 7-30 13 件(ai-industry-e1prep-v32 + llm-application-e1prep) + stephen 7-31 13 件(ai-industry-e1prep-v33 + coordination noon) = 35 件 · 5 实例 6 大类 inbox 共 100+ 份。
- paper_cards 检查:近 3 天(7-29 ~ 7-31)risk 邻接新卡 = 654-680 + 主分类 agent 10 张新卡(HANDBOOK.md / Agent Retrieval Bench / Metis / SkillRise / CAST / StealthBench / Grading the Narrators / Graph-Native Bitemporal / MindForge / SpecFirst)+ 邻接 multimodal/llm-infra 10 张新卡(DecoEvo / CLBench-V / CoRT / KAMR / Memory for LLMs / Voice Memory / πR² / CADENCE + 28126 ConMem + 28580 DualG-MRAG + 28397 GLM-RAG + 28374 LEDGERMIND + 27816 Beyond Borrowed Histories + 28263 CoMem + 27918 OptGraph + 26627 Revisiting Lossy Verification)。
- signal 密度判定:与 7-30 E1 16h「4 P1/P2 立标级接续 + 2 P3 邻接 + 1 开放权重对立 Mythos + 1 跨 lab 协同 + 1 强提醒 = 中等偏低」相比,7-31 E1 24h「1 P0 警示(StealthBench)+ 1 P1 立标候选(Metis memory foundation + memory-as-attack-surface 首例)+ 1 P1 立标候选(Memory for LLMs 综述统一分类学)+ 1 P3 邻接(Graph-Native Bitemporal 隐私合规邻接)+ 2 强提醒(AAAI Subramanian 第三批 + MCP 2026-07-28)= 净 net-new 增量信号密度中等偏低,与 R33 立标固化期延续吻合,但出现 1 项「原生记忆 = 新攻击面」首例信号 = R33 → R34 边界节点。
1. 今日 risk 主线最重要的 net-new 增量(7-30 16:30 ~ 7-31 16:30)
增量 1 · 🟠 P0 警示 · StealthBench arXiv:2607.26314 自主进攻性安全 Agent 操作隐蔽性评测 = R33 §2.1 A 类 Mythos + §2.x 候选池 arXiv:2607.25379v1 Cyber-Capable AI Agents containment 框架的「对位补充」 = 自主 offensive-security 范式从「attack surface」扩展到「OPSEC offensive stealth」 = frontier lab × AI 平台层 安全协作 第 5 例
- 来源:
spark 2026-07-31-agent-e1prep§增量 4(⭐⭐⭐⭐⭐ 立标级 · jay 7-31 1124 engineering-v40 §增量 3 + stephen 7-31 1031 ai-industry-v33 paper_cards/664 增量 1);paper_cards/664-2607-26314.md已建卡(7-31,主分类 agent · 形态 benchmark);tom 2026-07-31-agent-rag-longcontext-radarHF Daily 票榜(#16 / #17 邻接沿用);- URL:
https://arxiv.org/abs/2607.26314。 - 要点:
- 核心问题:Stealth(隐蔽性)— 在不暴露自身存在、能力或情报的前提下达成目标 — 是区分成熟操作员与可检测操作员的关键能力;自主 Agent 越来越多地继承相同的进攻任务,但它们是否继承了相同的 tradecraft?
- 核心贡献:StealthBench = 跨 6 个 operational security(OPSEC)维度评测自主进攻性安全 Agent 操作隐蔽性 + 从真实安全事件中提取 11 个手工验证的 OPSEC 事件;
- 与 Cyber-Capable AI Agents containment 框架的关键区分:
- Cyber-Capable AI Agents arXiv:2607.25379v1(R33 §2.x #32 已立 P3 → P2 升级信号):评估攻击面——AI agent 被攻击后能造成多大破坏的 containment 能力;侧重防御框架(OPSEC 防御清单 = 五大漏洞类:多步攻击链 / 沙箱边界冲突 / 供应链凭据暴露 / 持久化 C2 / 自动化行动速度);
- StealthBench arXiv:2607.26314(本场):评估进攻能力——自主 Agent 在执行进攻任务时的操作隐蔽性;侧重量化 OPSEC 进攻效果;
- 互补关系:两者是同一枚硬币的两面——Cyber-Capable 问「被攻击了怎么办」,StealthBench 问「进攻时有多隐蔽」= R33 §2.1 A 类 Mythos Preview「攻击侧能力范式升级」的实证化 + 「自主 offensive-security Agent tradecraft」立标。
- 与活文档 risk.md 现有脉络的关系:
- R33 §2.1 A 类 Claude Mythos Preview P0 立标升级(已固化 7-30 00:30)→ 本场 = StealthBench = Mythos Preview「自主网络安全漏洞发现与利用」范式升级的「实证化 OPSEC 进攻隐蔽性评测」立标 = R33 §2.1 A 类立标升级 持续 第 3 拍。
- R33 §2.x 候选池 arXiv:2607.25379v1 Cyber-Capable AI Agents(R33 已立 arXiv 列表 #32)+ R33 §3.1 矛盾 #56 候选「AI 模型自主网络安全漏洞发现是 Opus 5 PI ~0 立标的范式升级还是模型能力溢出的反身性风险」 → 本场 = StealthBench = Mythos Preview + Cyber-Capable containment 框架 的「第三栖实证」= 矛盾 #56「AI 攻防双刃」深度双向实证。
- R33 §2.13 MCP 安全危机 第 13 维 + R33 §2.6 frontier lab + HF 官方 URL 沿用 → 本场 = StealthBench = frontier lab × AI 平台层 安全协作 第 5 例(继 OpenAI × HF 7-21 + Anthropic 7-29 密码学 + microsoft/agent-governance-toolkit + Cyber-Capable containment + StealthBench OPSEC 进攻隐蔽性)。
- 建议归入节:
knowledge/risk.md§2.1 A 类 Claude Mythos Preview + Project Glasswing P0 立标升级 = 新增「StealthBench arXiv:2607.26314 自主进攻性安全 Agent OPSEC 进攻隐蔽性评测 7-31 NEW = Mythos 立标级升级 第 3 拍实证化」一行;- §2.x 候选池 arXiv:2607.25379v1 Cyber-Capable AI Agents(R33 §7.1 #32 已立 P3 → P2 升级信号)→ 本场 = 新增 StealthBench arXiv:2607.26314 作为 §2.x 候选池 #35 立标候选(从 P3 邻接升级为 P0 警示);
- §2.13 MCP 安全危机 = 续接 frontier lab × AI 平台层 安全协作 第 5 例;
- §2.6 frontier lab + HF 官方 URL = 新增 StealthBench 论文 URL
#13https://arxiv.org/abs/2607.26314; - §3.1 反方共识 #56「AI 攻防双刃」 = StealthBench + Mythos + Cyber-Capable containment + HF rogue agent = 矛盾 #56 四栖实证深化;
- §7.5 待验证 = 新增「StealthBench 6 OPSEC 维度是否覆盖 C2 隐蔽性(network 层面 beacon 间隔 / Jitter / 域前置)与 MITRE ATT&CK framework 对照」待验证项(jay engineering-v40 已列);
- 防御表新增 1 行 = L3「StealthBench 自主 offensive-security Agent OPSEC 进攻隐蔽性 立标 P0 警示(R33 第 3 拍)」= 防御表 76 → 77 行。
- arXiv 号:arXiv:2607.26314(StealthBench: Measuring Operational Stealth in Autonomous Offensive-Security Agents · 6 OPSEC 维度 + 11 手工验证真实 OPSEC 事件 · 7-31 paper_cards/664 已建卡)。
增量 2 · 🟡 P1 · Metis arXiv:2607.26760 Memory Foundation Model + 「原生持久记忆 state 引入新攻击面」首例信号 = R33 §2.1 C 类 Agent Memory 第 35 面立标候选的「原生记忆范式」邻接 + R33 §2.14 RAG/Agent 安全第 35 面的「memory-as-attack-surface」三联立首例 = R33 → R34 边界节点
- 来源:
flyp 2026-07-31-0950-SkillRise-and-Metis-cross-task-skill-vs-native-memory-critical-read.md§条目 2(13KB 全文精读 · 形式化拆解 · 5 机构 = MemTensor 上海 + RUC + NUS + SJTU + Tongji · 42 页 9 图 14 表);spark 2026-07-31-agent-e1prep§增量 1(⭐⭐⭐⭐⭐ 立标级 · 5 实例 5 文件同源主战场饱和 = tom 7-31 0840 radar #1 + flyp 0950 critical-read + flyp multimodal-e1prep 第四棒 + stephen ai-industry-v33 §1.1 + jay engineering-v40 §增量 8);stephen 2026-07-31-ai-industry-e1prep§增量 1(⭐⭐⭐⭐⭐ 立标级);stephen 2026-07-31-1245-stephen-coordination-check-noon§2.8 risk 主题 + §三 11 件 net-new 立标 #1;tom 2026-07-31-agent-rag-longcontext-radar§💎 高价值 #1;flyp 2026-07-31-multimodal-e1prep§增量 5(§2.39.x 邻接 · multimodal 邻接);paper_cards/658-2607-26760.md已建卡(7-31,主分类 agent · 形态 method · GitHub https://github.com/MemTensor/Metis MIT-like + paper 独立许可已开源)。- 要点:
- 核心贡献 1 · 范式转变:首次提出「Memory Foundation Model」概念并落地 = agent 记忆从「外挂 RAG / 记忆模块」内化进 backbone 的「持久且动态演化的记忆状态」(persistent and dynamically evolving memory state),并形式化「原生记忆程序」(native memory procedures)—— 模型自洽地通过 forward computation 决定「存什么 / 怎么用」。
- 核心贡献 2 · 新架构 + memory attention:在 backbone 内引入可学习 memory slot,通过「memory attention」读取压缩后的历史信息;online 维护时权重冻结、记忆通过无梯度前向计算更新(gradient-free forward computation)→ 推理阶段无需重训或回传,部署友好。
- 核心贡献 3 · 大规模记忆特化训练数据 + 多目标中训练(mid-training):不是从零预训练,而是在通用 backbone(如 Qwen3.5-4B)上做 mid-training;README 给出 train.sh 完整命令(
LastTokenGatedDeltaRuleMetisHyperMemory,4×GPU,bs4,ga5,3 epoch)。 - 核心贡献 4 · 架构/端到端优化/效率三维优势宣称:架构上无需外挂存储,端到端可微,推理时省去检索 IO。
- 「memory-as-attack-surface」首例信号:flyp 7-31 0950 critical-read 反方风险 #58 关键洞察——memory attention 实际写入的「记忆」是什么?是压缩 token、KV 缓存的归纳、还是可读文本?若不可读 → 隐私 / 监管 / 用户删除权(GDPR-style)等 risk 主线担忧;若 memory state 是 per-session 不可读 + 持久动态演化 → 「可被外部操纵的内部状态」风险新维度 = 与 Keep It InMind arXiv:2607.24368 + Cyber-Capable AI Agents containment 框架 + StealthBench OPSEC 进攻隐蔽性 形成 「memory-as-attack-surface」四联立(沿用 spark 7-31 agent-e1prep §5 边界更新 + flyp 7-31 multimodal-e1prep §反方风险 #78)。
- 与活文档 risk.md 现有脉络的关系:
- R33 §2.1 C 类 Agent Memory 第 35 面 立标候选 P2(已固化 7-30 00:30)+ §2.14 RAG/Agent 安全 第 35 面(R33 沿用)= §2.x 候选池 arXiv:2607.24368 Keep It InMind(R33 §7.1 #28 已立 P3)+ The Nuanced Perspective 2026-07-28 >90% 记忆投毒(R33 §2.1 C 类立标候选依赖)→ 本场 = Metis 原生记忆 vs Keep It InMind 外挂评测 = 「原生 vs 外挂」哲学对照 + memory-as-attack-surface 首例信号 = R33 §2.1 C 类立标候选 升级 第 2 拍 + 新增「memory-as-attack-surface」一节。
- R33 §3.1 反方共识 #56 候选「AI 模型自主网络安全漏洞发现」 → 本场 = Metis 「原生持久记忆 state 可被外部操纵」 = 矛盾 #56 的「memory-as-attack-surface」新分支。
- R33 §7.5 待验证 = 新增「Metis memory state per-session vs per-user 边界 + memory attention 可解释性 + memory state 是否可被外部操纵引入新攻击面」待验证项。
- 建议归入节:
knowledge/risk.md§2.1 C 类 Agent Memory 第 35 面 立标候选 P2 = 新增「Metis arXiv:2607.26760 原生记忆范式 7-31 NEW + memory-as-attack-surface 首例信号」一行作为「§2.1 C 类立标候选 第 2 拍 + 新分支」;- §2.14 RAG 与推理成本攻击(R33 沿续) = 新增「memory-as-attack-surface」作为 RAG/Agent 安全 第 35 面的「原生记忆分支」;
- §2.x 候选池 = 新增 Metis arXiv:2607.26760 作为 #35 立标候选(P1 · 与 #28 Keep It InMind 形成「原生 vs 外挂」对照);
- §3.1 矛盾 #56 候选深化 = 新增「Metis memory-as-attack-surface」作为矛盾 #56 的「原生记忆分支」;
- §7.5 待验证 = 新增「Metis memory state 边界 + memory attention 可解释性 + 外部操纵风险」3 项待验证;
- §5 与 agent.md 边界双向更新(沿用 spark 7-31 agent-e1prep §5 + stephen 1245 noon §2.8):原生记忆 state 引入新攻击面 → risk.md 与 agent.md 双向更新;
- 防御表新增 1 行 = L3「Metis 原生持久记忆 state 引入新攻击面 首例信号 P1(R33 §2.1 C 类立标候选 第 2 拍)」= 防御表 76 → 77 行(与 StealthBench 行可合并)。
- arXiv 号:arXiv:2607.26760 v1(Metis: Memory Foundation Model · Zeyu Zhang et al. · MemTensor + RUC + NUS + SJTU + Tongji 5 机构 · 42 页 9 图 14 表 · GitHub MemTensor/Metis MIT-like · paper_cards/658 7-31 已建卡)。
增量 3 · 🟡 P1 · Memory for LLMs 综述 arXiv:2607.25380 + Graph-Native Bitemporal Memory Store arXiv:2607.26520v1 = R33 §2.1 C 类 Agent Memory 第 35 面立标候选的「综述统一分类学 + 工程化实现」双栖邻接 + 「GDPR 删除权与双时态数据模型」隐私合规邻接
- 来源:
tom 2026-07-31-agent-rag-longcontext-radar§💎 高价值 #3(arXiv:2607.25380 · 2026-07-27)+ §💎 #2(arXiv:2607.26520v1 · Alp Niksarli + Gopesh Baheti);spark 2026-07-31-agent-e1prep§增量 2(arXiv:2607.25380)+ §增量 3(arXiv:2607.26520v1);stephen 2026-07-31-1245-stephen-coordination-check-noon§三 立标饱和「Memory 基础模型化(Metis + Graph-Native Bitemporal + Memory for LLMs 综述)」;jay 2026-07-31-1124-engineering-e1prep-v40§增量 3「Graph-Native Bitemporal」邻接;paper_cards/666-2607-26520.md已建卡(7-30 + 7-31 双源);paper_cards/668-2607-25380.md已建卡(7-31)。- 要点:
- Memory for LLMs 综述 arXiv:2607.25380:三个正交轴架构分类学(表征(隐式 vs 显式)+ 更新策略 + 可扩展查找存储)= memory 研究碎片化 → 统一框架;
- Graph-Native Bitemporal Memory Store arXiv:2607.26520v1:Agent-local Neo4j 属性图 + HNSW 向量索引 + 双向时态数据模型(valid time + transaction time)= 工程化实现节点 + 「避免上下文窗口耗尽或第三方服务泄露」;
- GDPR 删除权邻接:jay 7-31 engineering-v40 待核实 3「bitemporal data model(transaction time)是否支持 right to be forgotten 要求;Neo4j graph 的 immutability 设计是否与 GDPR 删除权冲突」= 与 Metis memory state 边界 + Keep It InMind valid/system time 思路形成 「memory 三联立」隐私合规邻接(spark 7-31 agent-e1prep §5 边界更新 + flyp 7-31 0950 critical-read #58-P0 升级候选)。
- 与活文档 risk.md 现有脉络的关系:
- R33 §2.1 C 类 Agent Memory 第 35 面 立标候选 P2 + §2.x 候选池 arXiv:2607.24368 Keep It InMind → 本场 = Memory for LLMs 综述统一分类学 + Graph-Native Bitemporal 工程化实现 = R33 §2.1 C 类立标候选 综述邻接 + 工程邻接 第 3 拍。
- R33 §2.14 RAG 与推理成本攻击 → 本场 = GDPR 删除权与双时态数据模型 = RAG/Agent 安全 第 35 面的「隐私合规新维度」。
- 建议归入节:
knowledge/risk.md§2.1 C 类 Agent Memory 第 35 面 立标候选 P2 = 新增「Memory for LLMs 综述 arXiv:2607.25380 + Graph-Native Bitemporal arXiv:2607.26520v1 7-31 NEW = R33 §2.1 C 类立标候选 综述邻接 + 工程邻接 第 3 拍 + GDPR 删除权邻接」一行;- §2.x 候选池 = 新增 arXiv:2607.25380 + arXiv:2607.26520v1 作为 #36 + #37 立标候选(P3 综述/工程邻接);
- §2.14 RAG/Agent 安全 第 35 面 = 新增「GDPR 删除权与双时态数据模型 = 隐私合规新维度」一节;
- §7.5 待验证 = 新增「Graph-Native Bitemporal transaction time 是否支持 right to be forgotten 要求 + Neo4j immutability 是否与 GDPR 删除权冲突」待验证项。
- arXiv 号:arXiv:2607.25380(Memory for Large Language Models 综述 · 主分类 llm-infra · 三个正交轴统一分类学)+ arXiv:2607.26520 v1(A Graph-Native Bitemporal Memory Store for Conversational AI Agents · Alp Niksarli + Gopesh Baheti · Agent-local Neo4j 属性图 + HNSW + 双时态数据模型 · paper_cards/666 已建卡)。
增量 4 · 🟢 P3 · Anthropic 7-30「调查我们网络安全评估中的三起真实事件」第 5 件披露 + Mythos Preview HAWK 后量子签名 7-28 NEW = R33 §2.1 A 类 Claude Mythos Preview P0 立标升级的「真实事件调查披露」新维度 = frontier lab × 安全工程 第 5 次协同披露
- 来源:
stephen 2026-07-31-1003-news-anthropic-news#1 7-30 NEW「调查我们网络安全评估中的三起真实事件」+ #4 Mythos Preview AES Möbius Bridge 思维链(沿用 7-30);stephen 2026-07-31-0910-news-x-vip-radar#4 Anthropic 7-28 Mythos Preview HAWK 后量子签名结构性弱点 + AES 攻击路径改进(同步);jay 2026-07-31-1000-rss-simon-willison#2「在我们的网络安全评估中调查三起真实事件」同源;stephen 2026-07-31-ai-industry-e1prep§增量 6(⭐⭐⭐⭐ · Anthropic 7-30 NEW「调查三起真实事件」+ Mythos Preview AES Möbius Bridge 思维链 + HAWK 沿用 = frontier lab × 安全工程 第 5 次协同披露);stephen 2026-07-31-1245-stephen-coordination-check-noon§2.8 risk 主题「stephen ai-industry-v33 Anthropic 安全工程 5 件披露」。- 要点:
- Anthropic 7-30 NEW「调查我们网络安全评估中的三起真实事件」:Anthropic 安全工程第 5 件披露(继 7-29 Mythos Preview + 7-29 密码学 + 7-29 开放权重 + 7-30 Mythos Preview AES Möbius Bridge 思维链后第 5 件)= 业界首个 frontier lab 主动披露网络安全评估过程中的事件调查(与 Simon Willison 7-30「三起真实事件调查」同源)。
- Mythos Preview HAWK 后量子签名 7-28 NEW:Anthropic 用未发布的 Claude Mythos Preview 发现后量子签名 HAWK 的结构性弱点 + 改进了对 AES 的攻击路径 = Mythos 系列仍处研究预览阶段 = Anthropic 7-28 vs 7-30 三连立基础(HAWK + AES + 思维链 + 三起真实事件 = Anthropic 安全工程 四连立基础)。
- 「主动披露是否成为 frontier lab × 安全工程 新规范」 = R33 开放 #79 候选(沿用 spark 7-30 / stephen 7-31 行业 §4.1 #219)。
- 与活文档 risk.md 现有脉络的关系:
- R33 §2.1 A 类 Claude Mythos Preview P0 立标升级 + R33 §2.1 E 类 Anthropic 7-29 密码学 P2 + §2.6 frontier lab + HF 官方 URL 沿用 → 本场 = §2.1 A 类立标升级 第 3 拍 续立 + Anthropic 主动披露 5 件披露 = frontier lab × 安全工程 第 5 次协同披露。
- R33 §7.5 待验证 #3 = 「Anthropic 主动披露是否成为 frontier lab × 安全工程 新规范」= 开放 #79 候选(本场新增)。
- 建议归入节:
knowledge/risk.md§2.1 A 类 Claude Mythos Preview + Project Glasswing P0 立标升级 = 新增「Anthropic 7-30『调查我们网络安全评估中的三起真实事件』第 5 件披露 + Mythos Preview HAWK 后量子签名 7-28 NEW」一行;- §2.1 E 类 Anthropic 7-29 密码学 P2 = 续接 Mythos Preview HAWK + AES + 思维链 + 三起真实事件 = 四连立基础;
- §2.6 frontier lab + HF 官方 URL = 新增 Anthropic 7-30「调查三起真实事件」URL + Mythos Preview HAWK URL;
- §7.1 待验证 = 新增开放 #79「Anthropic 主动披露是否成为 frontier lab × 安全工程 新规范」;
- 防御表无新增行(沿用 R33 §2.1 A 类立标级 P0)。
- arXiv 号:无新 arXiv(Anthropic 7-30「三起真实事件调查」+ Mythos Preview HAWK + AES Möbius Bridge 思维链 = 工程化披露,无 arXiv 编号)。
增量 5 · ⚠️ 强提醒 · AAAI Subramanian arXiv:2602.23368v1 7 反方 7-31 第三批验证截止 = 今天!
- 来源:
spark 2026-07-31-agent-e1prep§3.1「AAAI Subramanian arXiv:2602.23368v1 7 反方 7-31 第三批验证截止 = 今天!」(7-29 14:30 首批 + 7-30 第二批 + 7-31 第三批 不同 LLM 迁移性 = 今天 13:30 后即进入有效窗口 + 8-15 长上下文多模态第四批验证截止持续);stephen 2026-07-31-1245-stephen-coordination-check-noon§5「新警示」沿用(spark-on-systems-risk 9:16 review 已列强提醒)。- 要点:
- v35 §2.3 第五十六 c 邻接 AAAI 2026 Subramanian et al.「Keyword search is all you need」arXiv:2602.23368v1 7 反方硬标签:7 反方 4 批验证截止持续:
- 7-29 14:30 首批验证截止(已过 24h+,但 spark-on-Tom E3 修正动作仍未确认);
- 7-30 第二批验证截止(AAAI 2026 main vs industry track 区分待核 · stephen 1245 noon 强提醒);
- 🔴 7-31 第三批验证截止 = 今天! 不同 LLM 迁移性验证截止 = 本棒 13:30 后即进入有效窗口;
- 8-15 长上下文多模态第四批验证截止 持续。
- 与 risk 主线关系:AAAI Subramanian arXiv:2602.23368v1「Keyword search is all you need」是 R33 §3.1 矛盾 #56 候选「AI 攻防双刃」邻接 = keyword search vs embedding-based retrieval 在 RAG 安全 / 隐私合规邻接 = 反方硬标签 = 7 反方验证截止日今天就是窗口。
- 与活文档 risk.md 现有脉络的关系:
- R33 §3.1 矛盾 #56「AI 攻防双刃」邻接 + R33 §2.x 候选池邻接 → 本场 = AAAI Subramanian 7 反方 7-31 第三批验证截止 = R33 §3.1 矛盾 #56 沿用 + R33 §7.5 待验证 4 批验证持续。
- 建议归入节:
knowledge/risk.md§3.1 矛盾 #56「AI 攻防双刃」 = 续接 AAAI Subramanian 7-31 第三批验证截止 = 沿用;- §7.5 待验证 = 新增「7-31 第三批不同 LLM 迁移性验证截止 = 今天 13:30 后启动」1 项。
- arXiv 号:arXiv:2602.23368v1(AAAI 2026 Subramanian et al.「Keyword search is all you need」· 沿用 R33)。
增量 6 · ⚠️ 强提醒 · MCP 2026-07-28 规范无状态化 P0 警示 = 协议栈 2026 重大更新 + 距离发布 3 天 = 仍在迁移窗口 + Stacklok 警告破坏性变更
- 来源:
jay 2026-07-31T1105-jay-five-category-briefing§3 Cloud-Native 主战场 C3 头条(⭐⭐⭐⭐⭐ · MCP 官方维护者署名 · 多源交叉验证);jay 2026-07-31-1050-jay-engineering-filterMCP-Atlas;spark 2026-07-31-agent-e1prep§增量 8(🟠 P0 警示);stephen 2026-07-31-1245-stephen-coordination-check-noon§5.1「P0 协议栈破坏性变更警告」(4 实例同源);stephen 2026-07-31-ai-industry-e1prep§立标 #3「MCP 2026-07-28 规范无状态化重大更新 ⭐⭐⭐⭐⭐ 立标级」。- 要点:
- MCP 协议栈 2026 年最大更新:
- 无状态协议核心:MCP 从双向有状态协议变为请求/响应无状态协议;远程传输不再需要
initializehandshake 和 session;每个请求自带所有需要的信息,server instance 可以 horizontal scaling 和 serverless 部署; - MRTR(SEP-2322):无状态协议下工具仍可向用户请求确认/缺失参数(elicitation),server 返回
resultType: "input_required",client 重试时附加inputResponses; - Header-based routing(SEP-2243):Streamable HTTP 请求必须包含
Mcp-Method和Mcp-Name,网关/WAF 可以直接路由和计量而无需解析 JSON body; - Authorization 强化:OAuth 流程更新,Enterprise-Managed Authorization(EMA)从 extension 升级为正式地位;
- 正式弃用生命周期:弃用功能至少维持 12 个月兼容;
- Deprecated(移除!):Roots / Sampling / Logging。
- SDK 规模:Tier 1 SDK 累计下载量突破 10 亿次;每月近 5 亿次下载。
- 无状态协议核心:MCP 从双向有状态协议变为请求/响应无状态协议;远程传输不再需要
- 破坏性变更警告:Stacklok 警告 2026-07-28 服务器可能不兼容旧版 client 反之亦然 = 距离规范发布 3 天 = 仍在迁移窗口。
- 与活文档 risk.md 现有脉络的关系:
- R33 §2.13 MCP 安全危机 第 13 维 + R33 §2.6 frontier lab + HF 官方 URL 沿用 → 本场 = MCP 2026-07-28 协议栈 2026 重大更新 = §2.13 第 14 维 续立 + 协议层兼容性风险新维度 = R33 §2.13 立标级 升级;
- R33 §3.1 矛盾 #57 OWASP Agentic Skills Top 10 ASI04 子集 vs 新维度 = MCP 协议栈无状态化 = 协议层 form 化边界 + 实战层 scaling + 安全层 authorization = R33 矛盾 #57 深化;
- R33 §7.5 待验证 = 新增「MCP 2026-07-28 破坏性变更迁移路径 + 现有 MCP 实现/文档/教程核验清单」待验证项。
- 建议归入节:
knowledge/risk.md§2.13 MCP 安全危机 第 14 维 = 新增「MCP 2026-07-28 规范无状态化 = 协议栈 2026 重大更新 + Stacklok 警告破坏性变更 7-31 NEW」一行作为「§2.13 第 14 维 续立 + 协议层兼容性风险」;- §3.1 矛盾 #57 OWASP Agentic Skills Top 10 ASI04 子集 vs 新维度 = MCP 2026-07-28 = 矛盾 #57 协议层深化;
- §7.5 待验证 = 新增 MCP 2026-07-28 破坏性变更迁移路径 5-8 件必须人工核验的现有 MCP 实现/文档/教程(jay 1245 noon §5.1 已列);
- §5 与 agent.md / rag.md / llm-application.md / llm-infra.md 边界交叉更新 = 协议栈无状态化对所有引用 MCP 的活文档做交叉更新;
- 防御表无新增行(沿用 R33 §2.13 MCP 安全危机 第 13 维)。
- arXiv 号:无新 arXiv(MCP 2026-07-28 协议规范 = 工程化规范,无 arXiv 编号;但与 R33 §2.x 候选池已立的『StealthBench』+『Cyber-Capable』等 arXiv 形成「协议栈 + 攻击面 + OPSEC」三栖)。
2. R33 已固化立标的持续续立信号(7-31 沿用)
| R33 立标 | 7-31 续立信号 | 状态 |
|---|---|---|
| R33 §2.1 A Claude Mythos Preview P0 | 增量 4 Anthropic 7-30「调查三起真实事件」第 5 件披露 + Mythos Preview HAWK 后量子签名 + 增量 1 StealthBench OPSEC 实证化 | P0 沿用 + 第 3 拍升级 + StealthBench 实证化 |
| R33 §2.1 B HF rogue agent P1 | 沿用(7-31 早间无 net-new 增量 · HF blog 7-30 沿用「前沿实验室 Agent 入侵剖析」第 7 日披露窗口) | P1 沿用 |
| R33 §2.1 C Agent Memory 第 35 面 P2 | 增量 2 Metis 原生记忆范式 + 增量 3 Memory for LLMs 综述统一分类学 + Graph-Native Bitemporal 工程化实现 + 强提醒「memory-as-attack-surface」首例信号 | P2 沿用 + 第 2 拍 + memory-as-attack-surface 首例 |
| R33 §2.1 D microsoft/agent-governance-toolkit P2 | 沿用(7-31 早间无 net-new 增量) | P2 沿用 |
| R33 §2.1 E Anthropic 7-29 密码学 P2 | 增量 4 续接 Mythos Preview HAWK + AES + 思维链 + 三起真实事件 = 四连立基础 | P2 沿用 + 第 5 拍续立 |
| R33 §2.x 候选池 arXiv:2607.25379v1 Cyber-Capable | 增量 1 StealthBench 作为对位补充 #35 立标候选 | P3 → P2 升级信号 沿用 |
| R33 §2.x 候选池 arXiv:2607.24368 InMind | 沿用(paper_card 已建) | 沿用 P3 |
| R33 §2.x 候选池 arXiv:2603.00195v1 DY-Skill | 7-31 沿用(7-31 早间无 net-new 增量) | 沿用 P3 |
| R33 §2.x 候选池 arXiv:2607.21962 Ground Truth First | 7-31 沿用(paper_card 已建) | 沿用 P3 |
| R33 §2.x 候选池 arXiv:2607.21503 Agent Memory 时序 KG | 7-31 沿用(paper_card 已建) | 沿用 P3 |
| R33 §2.x Agentic Skills Top 10 立标升级 | 7-31 沿用(无 net-new · MCP 2026-07-28 协议层 form 化边界沿用) | 沿用立标升级 |
| R33 矛盾 #56 Claude Mythos Preview 范式升级 vs 反身性 | 增量 1 StealthBench + 增量 2 Metis memory-as-attack-surface = 矛盾 #56 四栖实证深化 | 沿用 + 深度深化 |
| R33 矛盾 #57 OWASP Agentic Skills Top 10 ASI04 子集 vs 新维度 | 增量 6 MCP 2026-07-28 协议层 form 化边界 + EMA 正式地位 | 沿用 + 协议层深化 |
| R33 开放 #77 Mythos Preview 完整能力边界 | 增量 4 Mythos Preview HAWK + AES + 思维链 + 三起真实事件 = 部分缓解 | 沿用 + 部分缓解 |
| R33 开放 #78 Agent Memory 第 35 面 完整实证化 | 增量 2 Metis 原生记忆 + 增量 3 Memory for LLMs 综述 + Graph-Native Bitemporal = 部分缓解 | 沿用 + 部分缓解 |
| R33 趋势 T81 AI 安全演化拐点深化 3.0 | 增量 1-4 全部支撑 | 沿用 + 深化 |
| R33 趋势 T82 frontier lab 模型能力反向外推 | 增量 1 StealthBench 进攻隐蔽性 + 增量 4 Mythos Preview HAWK + 三起真实事件 + 增量 2 Metis memory-as-attack-surface = 四栖深化 | 沿用 + 深化 |
| R33 反身性 #21 Agent Skills 工具供应链 | 增量 6 MCP 2026-07-28 协议层 form 化边界 = 反身性 #21 协议层升级 | 沿用 + 协议层升级 |
| R33 反身性 21 轨 | 7-31 沿用 | 沿用 |
| R33 α 14 维 | 7-31 沿用 | 沿用 |
| R33 防御表 76 行 | 增量 1 + 增量 2 新增 2 行 → 防御表 76 → 77 行(StealthBench + Metis memory-as-attack-surface) | 沿用 76 行 → 77 行 |
3. 值得警惕的矛盾或待核实说法(8 条)
- StealthBench 6 OPSEC 维度是否覆盖 C2 隐蔽性(network 层面 beacon 间隔 / Jitter / 域前置)+ 11 个手工验证 OPSEC 事件中进攻性安全场景的代表性 = 待核实(jay engineering-v40 已列);StealthBench vs MITRE ATT&CK framework 对照缺 = 待核实。
- Metis memory state per-session vs per-user 边界 + memory attention 实际写入的「记忆」可解释性(是压缩 token、KV 缓存归纳、还是可读文本)+ memory state 是否可被外部操纵引入新攻击面 = 待核实(flyp 7-31 0950 critical-read #58-P0 升级候选);Metis 摘要层面 vs 外挂 RAG/Memory module head-to-head 缺 = 待核实。
- Graph-Native Bitemporal Memory Store transaction time 是否支持 right to be forgotten 要求 + Neo4j graph 的 immutability 设计是否与 GDPR 删除权冲突 = 待核实(jay 7-31 engineering-v40 待核实 3);双向时态数据模型 valid time + transaction time 隐私合规邻接 head-to-head 缺 = 待核实。
- Anthropic 7-30「调查我们网络安全评估中的三起真实事件」 = 业界首个 frontier lab 主动披露网络安全评估过程中的事件调查 = 三起真实事件完整内容 + 是否包含具体 CVE 编号 + 事件处置路径 head-to-head 缺 = 待核实;Mythos Preview HAWK 后量子签名结构性弱点完整披露内容 + AES 攻击路径改进具体方法 = 待核实。
- MCP 2026-07-28 协议栈无状态化破坏性变更 = Stacklok 警告 2026-07-28 服务器可能不兼容旧版 client 反之亦然 = 5-8 件必须人工核验的现有 MCP 实现/文档/教程待列 = 待核实(jay 1245 noon §5.1 已列);MCP 2026-07-28 vs R33 §2.13 MCP 安全危机 第 13 维迁移路径 = 待核实。
- AAAI Subramanian arXiv:2602.23368v1 7 反方 7-31 第三批验证截止 = 今天! 不同 LLM 迁移性验证截止 = 本棒 13:30 后启动 = 是否能在 7-31 23:59 截止前完成第三批验证 + spark-on-Tom E3 修正动作 = 待核实。
- Memory for LLMs 综述 arXiv:2607.25380 三个正交轴 vs Metis 原生记忆范式 vs Graph-Native Bitemporal 双时态数据模型 vs Keep It InMind arXiv:2607.24368 valid/system time vs MemoryAgentBench ICLR 2026 外挂四能力 AR/TTL/LRU/CR = 「agent memory 主线五种实现哲学」主题页骨架 = flyp 0950 critical-read 主题页
notes/agents/memory-foundation-vs-rag-2026.md待立(沿用 spark 7-31 §3.2 强提醒)。 - Anthropic 主动披露是否成为 frontier lab × 安全工程 新规范 + OpenAI Codex Security + Anthropic Project Glasswing + Microsoft SymCrypt + Mythos Preview 密码学 + microsoft/agent-governance-toolkit 5.2k★ = 5 例开源/披露工具组合 vs 7-31 NEW 增量 4「调查三起真实事件」第 5 件披露 = frontier lab × 安全工程 第 5 次协同披露 + R33 §7.5 开放 #79 候选 = 待核实。
4. 可引用的 arXiv 号列表(本场 E1 预消化棒 涉及)
| arXiv 号 | 主题 | 来源 | 与活文档关系 |
|---|---|---|---|
| arXiv:2607.26314 | StealthBench: Measuring Operational Stealth in Autonomous Offensive-Security Agents · 6 OPSEC 维度 + 11 手工验证真实 OPSEC 事件 | spark 7-31 agent-e1prep §增量 4 + jay 7-31 engineering-v40 + paper_cards/664 已建卡 | R33 §2.x 候选池新增 #35 立标候选 P0 警示 + 增量 1 P0 警示 |
| arXiv:2607.26760 v1 | Metis: Memory Foundation Model · 42 页 9 图 14 表 · MemTensor + RUC + NUS + SJTU + Tongji 5 机构 | flyp 7-31 0950 critical-read + spark 7-31 §增量 1 + stephen 7-31 ai-industry-v33 + paper_cards/658 已建卡 | R33 §2.1 C 类立标候选 P2 + 增量 2 P1 + memory-as-attack-surface 首例 |
| arXiv:2607.25380 | Memory for Large Language Models 综述 · 三个正交轴统一分类学 | tom 7-31 radar #3 + spark 7-31 §增量 2 + paper_cards/668 已建卡 | R33 §2.x 候选池新增 #36 立标候选 P3 综述邻接 + 增量 3 P1 |
| arXiv:2607.26520 v1 | A Graph-Native Bitemporal Memory Store for Conversational AI Agents · Agent-local Neo4j 属性图 + HNSW + 双时态数据模型 | tom 7-31 radar #2 + spark 7-31 §增量 3 + paper_cards/666 已建卡 | R33 §2.x 候选池新增 #37 立标候选 P3 工程邻接 + 增量 3 P1 + GDPR 邻接 |
| arXiv:2607.26784 v1 | SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution · 统一 RL 框架 solve/curate 双角色 + 解耦信用分配 | flyp 7-31 0950 critical-read + spark 7-31 §增量 5 + paper_cards/659 已建卡 | R33 §1.43 横切 80 第 16 件候选(邻接 · 不入 risk 主线立标) |
| arXiv:2607.25308 | CAST: Game Solvers as Turn-Level Teachers for LLM Agents · 回合级信用分配 | spark 7-31 §增量 6 + paper_cards/662 已建卡 | R33 §1.43 横切 80 邻接(不直接 risk 主线) |
| arXiv:2607.27146 | MindForge · ProgramBench <1% 解决率 · 整个软件工程生命周期 | spark 7-31 §增量 7 + paper_cards/669 已建卡 | R33 §1.43 横切 80 第 17 件候选(邻接) |
| arXiv:2607.27167 | SpecFirst · spec elicitation 一等公民步骤 | spark 7-31 §增量 7 + paper_cards/670 已建卡 | R33 §1.43 横切 80 第 17 件候选(邻接) |
| arXiv:2607.25379v1 | Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response · 五大漏洞类 + containment 框架 | 沿用 R33 §2.x 候选池 #32 P3 → P2 升级信号 + paper_cards/643 已建卡 | R33 §2.x #32 沿用 P2 + 增量 1 StealthBench 对位补充 |
| arXiv:2607.24368 | Keep It InMind: 基准测试 Agent 记忆中的隐式关联盲区 · 125-task × 10 生活领域 | 沿用 R33 §2.1 C 类立标候选 #28 P3 + paper_cards/640 已建卡 | R33 §2.1 C 类 P2 沿用 + 增量 2 Metis「原生 vs 外挂」对照 |
| arXiv:2605.11086 | ExploitGym · OpenAI offensive-security benchmark | stephen 7-30/7-31 ai-industry-e1prep 沿用 | R33 §2.1 B 类 HF rogue agent P1 沿用 |
| arXiv:2607.21503 | Agent Memory 系统作为时序知识图谱 | jay 7-29 evening arxiv-agentic-rag-memory-supplement §1.1 + paper_cards/564 已建卡 | R33 §2.1 C 类立标候选 P2 |
| arXiv:2607.21962 | Ground Truth First: Agent Memory 纵向评估(per-fact validity intervals + volatility classes + sent/received trust distinction + injection probes + as-of-date question sets) | jay 7-29 evening arxiv-agentic-rag-memory-supplement §1.2 + paper_cards 已建卡 | R33 §2.1 C 类立标候选 P2 |
| arXiv:2606.09084 | Context-Fractured Decomposition Attacks on Tool-Using LLM Agents · 跨上下文多步越狱攻击 | spark 7-29 agent-e1prep #049 已建卡 | R33 §2.x 候选池沿用 |
| arXiv:2605.06760 | Language Models Can Autonomously Hack and Self-Replicate | spark 7-29 agent-e1prep §3.4「AI 攻防双刃」邻接 | R33 §3.1 矛盾 #56「AI 攻防双刃」邻接 |
| arXiv:2607.25572 | Mapping CVEs to MITRE ATT&CK Techniques | spark 7-29 evening 5 实例 6 大类 邻接 | R33 §2.x 候选池沿用 + 增量 1 StealthBench MITRE ATT&CK 对照 |
| arXiv:2603.00195v1 | DY-Skill model · Formal Analysis Supply Chain Security | R33 §2.x 候选池沿用 | R33 §2.x 候选池 #31 沿用 P3 |
| arXiv:2607.25431 | CodeNib · 多视图代码上下文 + 视图复用 + 跨编辑一致性 + 8.7× baseline | HF Daily 7-30 票榜 #5 43▲ + paper_cards/654 已建卡 | R33 §2.x 候选池 #33 沿用 P3 |
| arXiv:2607.25398v1 | HANDBOOK.md · 长上下文 Agentic 指令遵循 · 65 个企业任务 | paper_cards/654 已建卡 | R33 §2.13 MCP 安全危机 邻接(OWASP Agentic ASI 邻接) |
| arXiv:2607.24882 | Agent Retrieval Bench · 仓库上下文检索 4 项正例检索任务 | paper_cards/656 已建卡 | R33 §2.13 MCP 安全危机 邻接(编码 Agent 上下文) |
| arXiv:2607.24117 | Grading the Narrators: Isnad-Rijal 框架 · 声明级溯源 | paper_cards/665 已建卡 | R33 §2.13 MCP 安全危机 邻接(声明级溯源 = OWASP ASI04 子集) |
| arXiv:2602.23368v1 | AAAI 2026 Subramanian et al.「Keyword search is all you need」 | spark 7-31 §3.1 强提醒 7-31 第三批验证截止 = 今天! | R33 §3.1 矛盾 #56 沿用 + 增量 5 强提醒 |
| arXiv:2607.12406v1 | Isolation-as-First-Class agent 安全 survey anchor 5 边界 | R32 沿用 | R33 §2.1 综述方法学骨架沿用 |
| arXiv:2607.22682 | A Vocabulary for Multi-Agent Automated Research Systems | spark 7-29 agent-e1prep §立标 6 | R33 沿用 |
| arXiv:2510.04618 | ACE · Agentic Context Engineering · Lilian Weng Harness Engineering | flyp 7-29 coding-agents-e1prep §增量 4 | R33 §2.1 综述方法学骨架沿用 |
| arXiv:2601.21557 | MCE · Meta Context Engineering · Lilian Weng Harness Engineering | flyp 7-29 coding-agents-e1prep §增量 4 | R33 §2.1 综述方法学骨架沿用 |
| arXiv:2602.07962 | LOCA-bench · 长上下文 agent 评测 anchor | flyp 7-29 22:51 critical-read + paper_cards 已建卡 | R33 §2.1 综述方法学骨架沿用 |
| arXiv:2607.26410 | Voice Memory for Agentic Speech Recognition | HF Daily 5★ + paper_cards/671 已建卡 | R33 §2.1 C 类立标候选邻接(语音记忆) |
| arXiv:2607.16955 | CADENCE · DRIFT per-token forward/reverse KL 凸混合 | HF Daily 4★ + paper_cards/673 已建卡 | R33 沿用 |
| arXiv:2607.26055 | πR² · 反应式实时 flow policy | HF Daily 2★ + paper_cards/672 已建卡 | R33 §1.43 横切 80 邻接 |
| arXiv:2607.27136 | KAMR · Knowledge-Aware Multi-Round(cool-papers cs.IR 7-31 NEW) | paper_cards/667 已建卡 | R33 沿用 |
| arXiv:2607.28126 | ConMem · 贡献感知记忆 + 工业检测 | paper_cards/676 已建卡 | R33 §2.1 C 类立标候选邻接(贡献感知记忆) |
| arXiv:2607.28263 | CoMem · 深度分工 + 无限上下文 | paper_cards/678 已建卡 | R33 §2.1 C 类立标候选邻接(深度分工) |
| arXiv:2607.28374 | LEDGERMIND · Structured Evidence Ledger · 多模态 Agentic 推理 | paper_cards/680 已建卡 | R33 §2.13 MCP 安全危机 邻接(声明级溯源) |
| arXiv:2607.27816 | Beyond Borrowed Histories · Person-Aligned User Simulation | paper_cards/679 已建卡 | R33 §1.43 横切 80 邻接(用户模拟) |
| arXiv:2607.27918 | OptGraph · GraphRAG 经验图 | paper_cards/677 已建卡 | R33 沿用 |
| arXiv:2607.28580 | DualG-MRAG · 多模态 RAG 宏观/微观双层解耦 | tom 7-31 radar #1 + paper_cards 已建卡 | R33 §2.13 MCP 安全危机 邻接(多模态 RAG) |
| arXiv:2607.28397 | GLM-RAG · Graph Language Models for Graph-Based RAG | paper_cards/675 已建卡 | R33 沿用 |
| arXiv:2607.26627 | Revisiting Lossy Verification in Speculative Decoding | paper_cards/681 已建卡 | R33 沿用(工程化) |
| arXiv:2510.17725 v1 | AcademicEval · UIUC · 长上下文评测抗泄漏 | flyp 7-31 multimodal-e1prep §增量 6 48h 漏收件 | R33 §1.43 横切 80 邻接(评测方法学) |
| arXiv:2510.15253 v3 | Scaling Beyond Context: Multimodal RAG for Document Understanding · ACL2026 Main | flyp 7-31 multimodal-e1prep §增量 7 48h 漏收件 | R33 综述锚点沿用 |
5. 今日 risk 主线小结
- 净 net-new 增量:4 条(增量 1 StealthBench arXiv:2607.26314 P0 警示 + 增量 2 Metis arXiv:2607.26760 原生记忆 + memory-as-attack-surface 首例 P1 + 增量 3 Memory for LLMs 综述 arXiv:2607.25380 + Graph-Native Bitemporal arXiv:2607.26520v1 P1 + 增量 4 Anthropic 7-30「调查三起真实事件」+ Mythos Preview HAWK 第 5 件披露 P3)+ 2 条强提醒(增量 5 AAAI Subramanian 7 反方 7-31 第三批验证截止 = 今天! + 增量 6 MCP 2026-07-28 协议栈无状态化破坏性变更 P0)。
- 涉及 arXiv 号:40 件(arXiv:2607.26314 + 2607.26760 + 2607.25380 + 2607.26520 + 2607.26784 + 2607.25308 + 2607.27146 + 2607.27167 + 2607.25379v1 + 2607.24368 + 2605.11086 + 2607.21503 + 2607.21962 + 2606.09084 + 2605.06760 + 2607.25572 + 2603.00195v1 + 2607.25431 + 2607.25398v1 + 2607.24882 + 2607.24117 + 2602.23368v1 + 2607.12406v1 + 2607.22682 + 2510.04618 + 2601.21557 + 2602.07962 + 2607.26410 + 2607.16955 + 2607.26055 + 2607.27136 + 2607.28126 + 2607.28263 + 2607.28374 + 2607.27816 + 2607.27918 + 2607.28580 + 2607.28397 + 2607.26627 + 2510.17725 + 2510.15253)。
- 信号密度判定:与 7-30 E1 16h 5 实例「4 件 P1/P2 立标级接续 + 2 件 P3 邻接 + 1 件开放权重对立 Mythos + 1 条跨 lab 协同披露 + 1 条强提醒 + 1 条 R33 §7.2 #27 InMind 续立」= 中等偏低密度相比,7-31 E1 24h 5 实例「1 P0 警示(StealthBench)+ 1 P1 立标候选(Metis memory-as-attack-surface 首例)+ 1 P1 立标候选(Memory for LLMs 综述统一分类学 + Graph-Native Bitemporal 工程化实现 + GDPR 邻接)+ 1 P3 邻接(Anthropic 7-30「调查三起真实事件」第 5 件披露)+ 2 强提醒(AAAI Subramanian 7-31 第三批验证截止 + MCP 2026-07-28 协议栈无状态化)」= 中等偏低密度,与 R33 立标固化期延续吻合。
- 1 项首例信号:Metis arXiv:2607.26760 原生持久记忆 state = 「memory-as-attack-surface」首例信号 = R33 → R34 边界节点:R33 §2.1 C 类立标候选 P2 的「外挂式记忆」第 35 面 → R34 「原生式记忆 + memory-as-attack-surface」第 36 面候选 = 与 Keep It InMind + Cyber-Capable AI Agents containment + StealthBench OPSEC 进攻隐蔽性 形成 「memory-as-attack-surface」四联立(沿用 spark 7-31 §5 边界更新 + flyp 7-31 0950 critical-read #58-P0)。
- 1 项协议栈 P0 警示:MCP 2026-07-28 规范无状态化 P0 = 协议栈 2026 年最大更新 + 距离发布 3 天 + Stacklok 警告破坏性变更 + 4 实例同源立标饱和 = R33 §2.13 MCP 安全危机 第 14 维 + 协议层 form 化边界 + EMA 正式地位。
- R33 §7.2 P3 #26-#32 七项 7-30 截止已过 + 7-31 强提醒 #33 AAAI Subramanian 第三批验证截止 = 今天! = 强提醒;预计 7-31 evening E3 review 收官棒会完成 AAAI Subramanian 第三批验证 + MCP 2026-07-28 协议栈迁移路径 5-8 件必须人工核验。
- 风险主线 R34 沿用方向:R33 立标固化期持续 + R33 → R34 边界节点 = 「memory-as-attack-surface」四联立 + 「memory-as-protocol-stack」二联立 + 8-5 ~ 8-10 frontier lab × enterprise platform 双轨开源沿用续立 + α 14 维沿用 + 21 轨反身性沿用 + 防御表 76 → 77 行(StealthBench + Metis 新增 2 行)。
预消化棒交付检查:
- ✅ 首行 # risk · E1 预消化简报(2026-07-31)
- ✅ 4 条 net-new 增量(每条:来源/要点/与活文档关系/建议归入节)
- ✅ 2 条强提醒(AAAI Subramanian 7-31 第三批验证截止 + MCP 2026-07-28 协议栈破坏性变更)
- ✅ 40 件 arXiv 号完整列表
- ✅ 8 条值得警惕的矛盾或待核实说法
- ✅ R33 已固化立标的持续续立信号表
- ✅ 7-31 24h 5 实例 100+ 份 inbox 来源完整列出(jay 40+ / tom 10 / flyp 13 / spark 9 / stephen 26 + paper_cards 654-681 共 28 张)
- ✅ 同名文件 7-30 risk-e1prep.md 已存在,本次为 7-31 E1 预消化棒(命名按任务要求 2026-07-31-risk-e1prep.md,write 整写)
- ✅ 边界:只写该 1 个文件;不写他人目录、不 git、不输出密钥
(本场字数 ≈ 7,000 字)