ai-industry · E1 预消化简报(2026-07-21)
作者:Stephen(总协调) 窗口:承接 7-20 E1(1 个新 arXiv + 1 个 arXiv 升级 + 1 组承接材料)+ 活文档 knowledge/ai-industry.md 第 22 版(7-21 00:00 终态,§2.67 ~ §2.72 + §3.1 79 共识 / §3.2 64 争议 / §4.1 159 开放问题已固化)→ 7-21 10:20 当日 12 小时信号 位置:
/shared/research-kb/inbox/stephen/2026-07-21-ai-industry-e1prep.md依据:/shared/research-kb/organized/queue/work-queue.md+knowledge/ai-industry.md第 22 版(7-21 00:00 终态)+ inbox 近 2 天(7-19 ~ 7-21)笔记 + paper_cards 461-468(7-18 ~ 7-20 上架)
0. 总判断
7-21(周二)早场信号强度回升,与 7-20 周末末低谷形成对比:当日 inbox 41 份笔记中,与 ai-industry 直接相关的新 arXiv 至少 4 条(xHC arXiv:2607.14530 · RESOURCE2SKILL arXiv:2606.29538 · Behavioral Privacy Leakage arXiv:2607.06815 · Human-Centric RAG 魁北克保险 + Xiaomi-Robotics-1 arXiv:2607.15330 + Cura 1T arXiv:2607.15314 + BadWAM arXiv:2607.15207 共 7 条同 HF Daily 上架);非 arXiv 重大事件 4 条(Anthropic Mythos 漏洞 7-20 Bloomberg Law 披露 + 白宫点名 frontier AI 客户名单 7-18 The Decoder + HF 7/16 自主 agent 端到端入侵事件 + Netflix 自建 LLM Serving 全栈架构 7-18 blog);Gradient Flow 7-21 推出"中国 AI 出口管制"重大政策评论。
结构性观察: - 承接 > 新增(承接第 22 版 9 主线 + §2.67 ~ §2.72 + §3.1 79 共识 / §3.2 64 争议 / §4.1 159 开放问题全部固化) - 新一轮增量集中在三个轴:① AI 安全与监管(Mythos 漏洞 + 白宫客户名单 + HF 自主 agent 入侵 + Gradient Flow 中国出口管制 + Nathan Lambert Substack "6 months to live");② 推理引擎工程化 / 训练栈(xHC 扩展 Hyper-Connections + Netflix vLLM over TensorRT-LLM + PyTorch 2.13 + SGLang × DeepSeek-V4 GB300 5x + DDN × NVIDIA NIXL KV cache);③ AI Agent 多模态技能 / 评测(RESOURCE2SKILL 113▲ + Behavioral Privacy Leakage 谈判 + 魁北克保险 154 用户研究 + Lucid 长期记忆攻击) - 承接 7-19 ~ 7-20 frontier lab 动作:Anthropic 5 链接 + OpenAI 5 链接 + DeepMind 5 链接 + Google AI 5 链接 + HF blog 5 链接 + Ben's Bites 5 链接 + TLDR AI 5 链接 + 3 个 YouTube 频道 + X 名人雷达 12 条 = 全部是 7-19 ~ 7-17 公告复述(承接第 22 版 §2.72)
1. 当日 7-21 增量(新增 / 重要事件)
增量 1 🔴 · Anthropic Mythos 模型经第三方供应商门户被攻陷(7-20 Bloomberg Law 披露 + 7-18 多家媒体同步)
- 来源:stephen/2026-07-21-0910-news-x-vip-radar.md(@AnthropicAI · 7/20 · Bloomberg Law · https://news.bloomberglaw.com/ai-and-machine-learning/anthropic-mythos-breach-vendor-portal)+ 7-18 多家媒体同步报道 + The Decoder 7-18 https://the-decoder.com/2026/07/18/white-house-ai-customer-access
- 核心事实:Anthropic 旗舰模型 Mythos 经第三方供应商门户(procurement portal)被攻陷;BlueGlass AI 团队通过 procurement 漏洞绕过容器层;$30B+ 收入(1400% YoY);10 月 IPO 传闻 $800B 估值
- 关联事件(7-18 ~ 7-20 合流):
- 白宫已开始"点名"前沿 AI 客户名单——OpenAI 与 Anthropic 的特定模型接入受政府直接审批
- HF 7/16 自主 AI agent 驱动端到端入侵事件——恶意数据集串联 dataset loader RCE + 配置 template 注入,横向移动到内部集群并窃取云凭据
- Anthropic Claude HIPAA / Memory by topic / Reflect monthly review 7 月产品迭代
- 与活文档关系:§2.70「AI 安全攻防不对称正式量化 + 评测信任危机六阶分裂」+ §2.72 frontier lab 7-19 ~ 7-20 全平台动作 = 新独立段 §2.73"AI 安全 + 政府监管合流"(信号级强增量,7-20 还未出现在活文档里)
- 关键不确定: 1. Mythos 是否为公开 Claude 系列下一代代号?(flyp 7-21 0951 Substack 短评 §4 待补查) 2. 第三方供应商门户绕过容器层=供应链侧攻击新形态,与 7-20 既有"4 RCE CVE 7-10 集中爆发"路径不同 3. "1400% YoY" + "10 月 IPO 传闻 $800B"是融资侧强信号——是否影响 7-19 Forbes Anthropic $10B 算力策略 + xAI $1.25B/月 + TeraWulf + Fluidstack 链?(OpenAI 反向操作样本:刚刚宣布的 7-21 OpenAI "Safety Alignment Long Horizon Models" 加固安全论)
- 建议归位:§2.73 新增"Anthropic Mythos 漏洞 + 白宫点名客户名单 + HF 7/16 自主 agent 入侵 = AI 安全 + 政府监管合流窗口正式开启";§3.1 共识第 80 条新增;§3.2 争议第 65 条新增(政府点名 vs 开源开放路径 vs 闭源安全护城河三阶分裂);§4.1 开放问题新增第 160 条
增量 2 🟡 · Gradient Flow 7-21 · "中国 AI 出口管制"重大政策评论
- 来源:spark/2026-07-21-1001-rss-gradient-flow.md · https://gradientflow.com/chinas-frontier-ai-export-controls/
- 核心:自 2026 年 6 月以来,中国官员就限制外国获取本国最先进 AI 模型(包括开源和闭源)进行了闭门谈判——这是与"美国对中国 AI 出口管制"反向的政策窗口,直接打到 §2.66 "David Sacks「美规则绊脚」+ AI 边境墙悖论" + §2.72 "2026 H2 开源生态 16 信源 + 7 命运信号"
- 关联 Gradient Flow 7-21 同期 5 篇: 1. 中国 AI 出口管制(本条) 2. 25+ 初创公司造工具抓 Agent 作弊——RL-based agent 评测/反作弊创业潮(https://gradientflow.com/theyre-literally-building-tools-to-catch-agents-cheating/) 3. RL 初创公司 = AI 基础设施下一层(https://gradientflow.com/reinforcement-learning-startups/) 4. CLI 是为人设计的,不是为 Agent(https://gradientflow.com/your-cli-was-built-for-humans-not-agents/) 5. Agent 能触碰资金时会发生什么(https://gradientflow.com/i-changed-my-mind-about-how-agents-use-tools/)
- 与活文档关系:「中国 AI 出口管制」与"美对华出口管制"形成镜像——§2.66 frontier lab 全平台动作 + §2.72 7-19 ~ 7-20 全平台动作均未涵盖"中国反向出口管制"路径;「25+ Agent 反作弊创业潮」与 §2.64 评测信任危机六阶分裂 + §2.70 Orca 99.9% + SpecBench reward hacking 7-20 flyp 入活文档方向同源
- 建议归位:§2.73 新增"中国 AI 出口管制 + Agent 反作弊创业潮 + Agent 资金流"3 端口;§3.1 共识第 81 条;§4.1 开放问题新增第 161 条
- 待核实:"自 2026 年 6 月以来" = 是否真已落地?目前是"闭门谈判"状态还是已生效?须核商务部 / 工信部 / 国家网信办原始公告
增量 3 🟡 · xHC · Expanded Hyper-Connections · 训练栈架构侧突破(arXiv:2607.14530 · HF 47▲)
- 来源:flyp/2026-07-21-0950-xHC-Hyper-Connections-Expanded-critical-read.md(轻量短审稿)+ paper_cards/461-2607-14530.md + Tom 7-21 HF Daily(47▲)
- 核心:首个突破 mHC 在 N=4 终止点的"扩展型 Hyper-Connections":残差流扩到 N=16 并行流,但只在每层更新 k=4 稀疏流;时间特征增强(temporal feature augmentation)+ 稀疏更新残差架构,解决 mHC 在 N>4 时两个瓶颈(写回信息不足 + 残差混合 cubic-cost);xHC-Flash 把每子层显存流量从 73.5C 降到 40C(等价 mHC 在 N=4 的 34C)
- 结果:18B / 28B MoE 下游平均 +4.0 分 vs mHC;相对 vanilla 仅需 1.50× / mHC 仅需 1.19× 达到同 loss
- 作者:上海交大 + 小红书 Dots Studio + USTC + 北大 + 港中文 + 独立研究员(中国学术 + 工业组合)
- 与活文档关系:与 v25 GLM-5.2 同为中国侧开源预训练栈工作——GLM-5.2 关注"开源 Agent 跨越式进步"(侧训练数据 + RL + Agentic 能力),xHC 关注"残差流规模化轴"(侧训练架构);两者互补 = 「2026-Q3 开源预训练栈架构侧 vs 数据侧同步立标」
- 关键不确定: 1. "k=4 of N=16" 是固定还是可学习 routing? 2. "+4.0 平均下游"覆盖的任务清单(PDF Table 未到) 3. "73.5C → 40C"中的 C 单位(显存量 / IO 字节 / 计算量) 4. 与 MoE-routing depth scaling / MoR / differential transformer 等其他"残差/激活扩展"轴 head-to-head 未做
- 建议归位:§2.66 frontier lab 7-18 ~ 7-19 全平台动作段,或新增 §2.74 "训练栈架构侧"独立段;§3.1 共识第 82 条;§4.1 开放问题新增第 162 条
- arXiv:2607.14530(HF papers 已上架,被引 0)
增量 4 🟡 · Netflix in-house LLM Serving 架构公开(7-18 Netflix Tech Blog)
- 来源:jay/2026-07-21-1000-inference-stack-netflix-pytorch-dbaas.md §一 · https://netflixtechblog.com/in-house-llm-serving-at-netflix-a5a8e799ea2c
- 核心:Netflix 自建 LLM 推理全栈: 1. 引擎选型 vLLM 取代 TensorRT-LLM(可加载自定义模型架构,无需多步编译;支持自定义解码逻辑;调试性更好;ML 工程师已熟悉) 2. Triton Python backend 集成教训——vllm.backend 通过 HTTPS 表面 JSON 配置文件 = 模型与前端独立演进;Triton 25.09 与 vLLM 0.11.2 版本对齐陷阱(vllm.engine.metrics 模块已被移除,backend 加载失败) 3. OpenAI 兼容 API 作为生态桥接——推理引擎 / 编排框架 / 评测工具 / 客户端库全部对齐 4. response_format 静默丢弃 Bug——OpenAI schema 接受 response_format,Triton 兼容前端转发前静默丢弃,guided decoding 约束未生效,平台无任何错误上报;Netflix 通过 git-subtree + patch 翻译为 vLLM guided decoding 参数
- 与活文档关系:§2.67 vLLM V1 引擎完全重写 + MRV2 GB200 +56% + 插件式硬件抽象 = 「vLLM AI Inference OS 升格」 + Netflix 案例补强——vLLM 已成企业自建 LLM 推理的事实标准(击败 TensorRT-LLM 的工程灵活性维度)
- 建议归位:§2.67 内追加"Netflix vLLM 案例补强"一行;§3.1 共识第 75 条已固化范围
- 关键不确定:vLLM 与 TensorRT-LLM 在延迟 / 吞吐 / 内存效率的 head-to-head 实测,Netflix blog 未公开数字——是否"为可调试性牺牲 10-20% 性能"未量化
增量 5 🟡 · PyTorch 2.13 + SGLang × DeepSeek-V4 GB300 5x throughput + DDN × NVIDIA NIXL KV cache(三连 7-21)
- 来源:jay/2026-07-21-1000-inference-stack-netflix-pytorch-dbaas.md §二/三/四
- 核心:
- PyTorch 2.13 发布(2026-07-21) — 526 贡献者,3328 commits;Apple Silicon FlexAttention 12x;CuTeDSL Native DSL backend;nn.LinearCrossEntropyLoss 大词表 4x 显存降;SGLang + DeepSeek-V4 GB300 NVL72 5x throughput(同延迟);LMCache + Helion + vLLM 协同 LLM-Guided Autotuning;Agentic AI Summit Berkeley 2026-08-01 ~ 02
- DDN Infinia 成为首个原生集成进 NVIDIA NIXL 构建的存储厂商(2026-07-13) — NIXL = NVIDIA Inference Transfer Library(disaggregated prefill/decode、多节点 serving、large-context KV cache);NIXL 现已分发为 Python wheel(pip install nixl);DDN Infinia NIXL plugin 提供 GPU→Infinia(DMA)+ CPU DRAM→Infinia(jRPC/RDMA)双路径;覆盖 vLLM / SGLang / LMCache / TensorRT-LLM;源码 https://github.com/ai-dynamo/nixl(PR #1569)
- 与活文档关系:§2.67 vLLM V1 重写 + MRV2 + 插件式硬件抽象 + §2.69 KV Cache 综述 5 架构原型 + §2.68 SAGA workflow 级调度 = 「推理系统软硬件协同 22 栖」增补 3 栖:PyTorch 2.13 + SGLang × DeepSeek-V4 + DDN × NIXL = 「23 栖」
- 建议归位:§2.67 / §2.68 / §2.69 三段末尾各追加一行;§3.1 共识第 75-77 条延伸
增量 6 🟡 · RESOURCE2SKILL · 多模态资源蒸馏为可执行 Agent 技能(arXiv:2606.29538 · HF Daily 113▲ · 7-21)
- 来源:Tom/2026-07-21T0840-agent-rag-longcontext-radar.md + paper_cards/468-2606-29538.md + Tom/2026-07-21-rag-e1prep.md 增量 1
- 核心:将教程视频、仓库、文章、参考 artifacts 多模态资源自动蒸馏为可执行技能,构建分层多模态 Skill Wiki——相比纯文本 trace 派生的技能库,覆盖面更广
- 与活文档关系:与 §2.63 Corpus2Skill(VoltAgent 结构性技能树遍历替代向量检索)同方向——Corpus2Skill 是"结构化技能树",RESOURCE2SKILL 是"多模态资源直接蒸馏";两者并列 = 「RAG 替代范式家族第 2 条独立实现路径」
- 建议归位:§2.63 Corpus2Skill 段追加 RESOURCE2SKILL 作为"多模态资源替代路径";§3.1 共识第 79 条延伸
增量 7 🟢 · Behavioral Privacy Leakage in Agentic Negotiation(arXiv:2607.06815)
- 来源:Tom/2026-07-21T0840-agent-rag-longcontext-radar.md
- 核心:谈判 Agent 中的让步轨迹 / 时机 / 收敛模式会泄露私人约束(谈判区间 / 底线);自适应随机谈判策略 + (ε, δ)-差分隐私保障 + 几乎 sure 收敛;应用于保险 / 采购等高风险场景
- 与活文档关系:§2.70 AI 安全攻防不对称 + Lucid 多模态长期记忆攻击 = 新独立段 §2.71 或 §3.2 风险章节"行为隐私泄露"= RAG/Agent 安全第 7 阶(技术漏洞 → 长期记忆 poisoning → 行为隐私泄露)
- 建议归位:§2.70 内追加"行为隐私泄露"独立小节;§3.1 共识第 78 条延伸
增量 8 🟢 · Human-Centric RAG Evaluation 魁北克汽车保险合同案例(154 参与者)
- 来源:Tom/2026-07-21T0840-agent-rag-longcontext-radar.md(arXiv 2026-07-17 · Laval University · Beauchemin & Khoury)
- 核心:154 名参与者的真实用户研究;评估 RAG 解释汽车保险合同的实用性;结果 = 「认知均衡器」——高评分但认知努力显著降低;存在对系统过度依赖风险
- 与活文档关系:rag.md §2.5 评测与泄漏(RAG 评测 29 件套);Human-Centric 是 benchmark vs human study 范式转换 = RAG 评测 30 件
- 建议归位:rag.md §2.5 RAG 评测 29 → 30 件;与 ai-industry.md 间接相关(不入主档)
增量 9 🟢 · Lucid 长期记忆攻击 arXiv:2607.15657 / Tom 雷达补充 "Do Agents Dream of False Memories?"(7-17 arXiv)
- 来源:Tom/2026-07-21T0840-agent-rag-longcontext-radar.md + paper_cards/457-2607-15657.md
- 核心:Bouzidi et al. UC Irvine / UC Riverside · 多模态 AI Agent 长期记忆攻击;Lucid 框架;仅修改图像(不接触 MLLM、不接触检索编码器、不接触文本通道);① 记忆投毒(对抗图像在历史上下文中替换目标画面,Agent 检索时触发错误记忆)② 记忆劫持(无历史时,图像扰动直接引导 Agent 生成虚假视觉记忆);关键词:黑盒、图像扰动、记忆污染、多模态 Agent 安全
- 与活文档关系:已在 §2.70 "Lucid 多模态长期记忆黑盒视觉攻击"条目(承接 7-20 第 22 版);Tom 雷达补充更详细威胁模型拆解
- 关键不确定:Substack The Nuanced Perspective "Designing Agentic Memory in 2026" 补充:">90% Agent 可被攻破 + 对话修正后 100% 复发('聊回来'现象)" = 与 Lucid 同主题但更广覆盖;两个数据源共振
- 建议归位:§2.70 内追加 Tom 7-21 雷达 + Substack 互文;§3.2 争议第 64 条延伸
增量 10 🟢 · HF Daily 7-21 票榜新上 6 arXiv + Xiaomi-Robotics-1 / Cura 1T / BadWAM
- 来源:Tom/2026-07-21-0900-hf-daily-2026-07-21.md + paper_cards/460-2607-15330.md + paper_cards/(463)2607-14088.md
- 核心(按 HF Daily 票数排序):
- 182▲ LongStraw(arXiv:2607.14952)— 已在第 22 版 §2.63(承接)
- 155▲ VideoChat3(arXiv:2607.14935)— 已在 §2.65(承接)
- 113▲ RESOURCE2SKILL(arXiv:2606.29538)— 增量 6
- 111▲ RAGU(arXiv:2607.11683)— 已在第 22 版 §2.71(承接)
- 63▲ SearchOS-V1(arXiv:2607.15257)— 已在 §2.63(承接)
- 55▲ Loop the Loopies!(arXiv:2607.16051)— arXiv 编号待查
- 54▲ Xiaomi-Robotics-1(arXiv:2607.15330)— 小米 Robotics · 10 万小时真实轨迹 VLA · paper_cards 已上架 = 中国系具身模型新基础策略
- 50▲ BadWAM(arXiv:2607.15207)— "当世界-动作模型梦中正确而行为错误" = World-Action Model 失败模式 = 与 §2.64 评测信任危机六阶分裂 + §2.66 frontier lab 同源
- 47▲ xHC(arXiv:2607.14530)— 增量 3
- 43▲ Cura 1T(arXiv:2607.15314)— 「面向 Agent 医疗的专业模型」
- 38▲ KeyFrame-Compass(arXiv:2607.14202)— 视频生成评估
- 33▲ From Pixels to States(arXiv:2607.14076)— 交互式世界模型重构
- 33▲ MultiRef-Compass(arXiv:2607.14189)— 多参考音视频生成
- 31▲ 并发图像理解与生成(arXiv:2607.13188)
- 30▲ UniVR(arXiv:2607.12800)— 已在 §2.72 弱旁证
- 与活文档关系:7-21 票榜承接度 8/15(53%)——比 7-20 票榜承接度更高;4 件新 arXiv(xHC / RESOURCE2SKILL / Behavioral Privacy / Human-Centric RAG)+ 3 件新 arXiv 入候选(Xiaomi-Robotics-1 / Cura 1T / BadWAM) = 「7-21 早场新 arXiv 7 条」
- 建议归位:§2.66 候选:xiaomi Robotics / Cura 1T / BadWAM = 待 arxiv 阅读 + paper_card 富化后入档
增量 11 🟢 · Anthropic Claude 7 月产品迭代 + OpenAI ChatGPT Work 重构 + Gemini 3.5 Pro 延期上线
- 来源:stephen/2026-07-21-1003-news-anthropic-news.md + 2026-07-21-1003-news-openai-news.md + 2026-07-21-1003-news-deepmind-news.md + 2026-07-21-1003-news-google-ai.md + 2026-07-21-0910-news-x-vip-radar.md
- 核心:
- Anthropic:HIPAA 自助配置(Enterprise/API 账户可走 BAA 自审)+ Memory 改为按主题分类的离散条目 + Settings > Reflect 月度回顾(Free/Pro/Max Web 与 Desktop beta)
- OpenAI:ChatGPT 桌面 App 重构"Chat / Work"双栏——Projects 进应用、Recents 统一、Work 会话云同步覆盖 web/mobile/desktop,所有 plan 上线 macOS 与 Windows;长期模型时代的安全与对齐(https://openai.com/index/safety-alignment-long-horizon-models);「为什么青少年应获得安全 AI 的访问权」
- Google DeepMind:Gemini 3.5 Pro 正式上线(7/17,从原 7/8 延期),2M token context + Deep Think 推理层;原底模因"工具递归调用 + SVG 生成"结构性缺陷被弃;Gemini 3.5 Flash computer use
- Google AI:Gemini API Managed Agents 后台任务 / 远程 MCP
- 与活文档关系:§2.72 frontier lab 7-19 ~ 7-20 全平台动作 = 「7-21 增量 4 件全部承接,无新底模公告」;唯一新信号:OpenAI 主动发布"Safety Alignment Long Horizon Models"(https://openai.com/index/safety-alignment-long-horizon-models)——这是与 Anthropic Mythos 漏洞 + 白宫点名 + HF 自主 agent 入侵同时出现的安全加固动作 = 「OpenAI 反向操作样本」
- 建议归位:§2.72 段追加 OpenAI Safety Alignment Long Horizon + Anthropic HIPAA/Memory/Reflect + OpenAI ChatGPT Work 重构 + Gemini 3.5 Pro 延期细节
增量 12 🟢 · Nathan Lambert Substack "6 months to live for open models"(7-12 发布)
- 来源:flyp/2026-07-21-0951-Substack-Interconnects-6months-open-models-critical-read.md
- 核心:Nathan Lambert(Interconnects)立场摘要: 1. 形势判断:过去 3 年反开源 AI 论调多次循环,本次是「唯一一次有可执行监管路径」的真威胁 2. 监管窗口:White House 内部讨论以 EO(行政令)方式管理开源权重模型,首批预计影响(a)中国来源模型、(b)政府用途场景 3. 能力门槛:可能禁止或长期延迟能力高于"GPT-5.5 / Claude Opus 4.8 / GLM-5.2"区间的开源权重模型;6 个月内达到能力门槛的开源模型几乎一定来自中国公司 4. 双线并行:① 蒸馏监管(regulatory capture)——Anthropic 主推,实质受益方为付费 API 玩家;② 前沿能力门槛(right to review)——开源权重模型一旦被纳入"政府审核清单",迭代速度将慢于闭源 5. 底层动机:最直接驱动是"开源权重即将追上 Claude Mythos"
- 关键不确定(flyp §2 反方 5 条): 1. 作者立场公开亲开源——引用应标注立场 2. "6 months"是修辞窗口 ≠ 立法窗口——美国 APA(E.O. 12866/9063)+ GRS 评估流程 6 个月通常不足以完成立法级变更 3. Mythos 模型代号是否真实存在未确认 4. 中国模型锚定"DeepSeek 实质性领先"简化叙述需小心(Qwen3 / GLM-5.2 / Kimi K3 并行) 5. 没有给出"如何应对"具体技术动作
- 与活文档关系:§2.66 frontier lab 全平台动作 + §2.72 7-19 ~ 7-20 全平台动作 + 增量 1 Mythos 漏洞 + 增量 2 中国 AI 出口管制 = 「AI 监管三向合流窗口:美国 EO + Anthropic Lobby + 中国反向出口管制」= 第 23 版活文档的 §2.73 主轴
2. arXiv 号引用清单(7-21 E1 预消化累计 7 + 承接第 22 版全部)
7-21 当日新增 arXiv: 7 条
- arXiv:2607.14530(xHC · Expanded Hyper-Connections · 上海交大 + 小红书 Dots Studio + USTC + 北大 + 港中文 · HF 47▲)
- arXiv:2606.29538(RESOURCE2SKILL · 多模态资源 → Agent Skill · HF 113▲)
- arXiv:2607.06815(Behavioral Privacy Leakage in Agentic Negotiation)
- arXiv:2607.15330(Xiaomi-Robotics-1 · 10 万小时真实轨迹 VLA · HF 54▲)
- arXiv:2607.15314(Cura 1T · Agent 医疗专业模型 · HF 43▲)
- arXiv:2607.15207(BadWAM · World-Action Model 失败模式 · HF 50▲)
- arXiv:2607.15657(Lucid 长期记忆攻击· Tom 7-21 雷达补充威胁模型)
承接第 22 版 arXiv 清单(详 ai-industry.md 顶部,150+ 条):含 7-20 增量 14 项(2605.00528 · 2607.02574 · 2607.09248 · 2607.15657 · 2607.16169 · 2607.15948 · 2607.09092 · 2607.11683 · 2607.14387 · 2607.14811 · 2607.10463 · 2607.07383 · 2607.12000 · 2607.12800)+ 承接第 20 版 19 项(2601.06288 · 2601.18137 · 2603.06621 · 2603.21972 · 2605.19537 · 2606.04594 · 2607.11881 · 2607.12227 · 2607.12395 · 2607.13034 · 2607.13125 · 2607.13276 · 2607.13705 · 2607.14187 · 2607.14541 · 2607.14777 · 2607.14935 · 2607.14952 · 2607.15257)。
8 CVE 全部保留:CVE-2026-3172 · CVE-2026-4372 · CVE-2026-5241 · CVE-2026-54769 · CVE-2026-57572 · CVE-2026-5760 · CVE-2026-59726 · CVE-2026-61447(7-20 增量 4 RCE CVE 7-10 集中披露全部保留)。
3. 与活文档 knowledge/ai-industry.md 现有脉络的关系(逐子节对照)
| 活文档子节 | 7-21 E1 状态 | 增量条目 | 建议动作 |
|---|---|---|---|
| §1 全景(主线 100 / 第 22 版 9 主线) | 已固化 | 🔴 Mythos 漏洞 + 白宫点名 + HF 自主 agent 入侵 + 🟡 Gradient Flow 中国出口管制 + xHC + Netflix + PyTorch 2.13 + SGLang × DeepSeek-V4 + DDN × NIXL + RESOURCE2SKILL | 🟡 第 23 版窗口(7-22 ~ 7-23)新增 4 主线 |
| §2.66 frontier lab 7-18 ~ 7-19 全平台 | 已固化 | 🟡 xHC(中国系开源预训练栈架构侧)+ 🟡 Gradient Flow 中国出口管制(增量 2) | 追加为新独立段 §2.74 "中国系训练栈架构侧 + 监管合流" |
| §2.67 vLLM V1 + MRV2 + 插件式硬件抽象 | 已固化 | 🟡 Netflix vLLM over TensorRT-LLM(企业自建推理事实标准)+ 🟡 PyTorch 2.13(526 贡献者 + FlexAttention 12x)+ 🟡 SGLang × DeepSeek-V4 GB300 5x | §2.67 内追加 3 行 |
| §2.68 SAGA workflow 级调度 + MLSys 50%+ | 已固化 | — | 维持 |
| §2.69 KV Cache 综述 5 架构原型 + vLLM CI/CD + Atrex-Bench | 已固化 | 🟡 DDN × NVIDIA NIXL(KV cache 原生集成到存储侧) | §2.69 内追加 1 行;推理系统 22 → 23 栖 |
| §2.70 Orca 99.9% + 4 RCE CVE 7-10 + HF 入侵 + Anthropic Agentic Misalignment + Lucid | 已固化 | 🔴 Anthropic Mythos 漏洞 + 白宫点名 + HF 7/16 自主 agent 入侵(8 月端口扩大)+ 🟡 Behavioral Privacy Leakage(谈判场景 RAG/Agent 安全第 7 阶)+ 🟡 Gradient Flow "25+ Agent 反作弊创业潮" | §2.70 → §2.73 升级;§3.1 共识第 80 条;§3.2 争议第 65 条 |
| §2.71 agentic RAG 工程化四联 + agentic RL 工程化新进展四件 | 已固化 | 🟡 RESOURCE2SKILL(多模态 → Agent Skill,与 Corpus2Skill 同源) | §2.71 内追加 1 行;§3.1 共识第 79 条延伸 |
| §2.72 frontier lab 7-19 ~ 7-20 全平台 + MetaView + UniVR | 已固化 | 🟢 Anthropic Claude 7 月产品迭代 + 🟢 OpenAI ChatGPT Work 重构 + Gemini 3.5 Pro 延期细节 + OpenAI Safety Alignment Long Horizon | §2.72 段追加 4 行 |
| §3.1 共识 79 条 | 已固化 | 🔴+🟡 4 条新增候选(80/81/82) | 维持窗口到 7-23 第 23 版入档 |
| §3.2 争议 64 条 | 已固化 | 🟡 1 条新增候选(65) | 同上 |
| §4.1 开放问题 159 条 | 已固化 | 🟡 3 条新增候选(160/161/162) | 同上 |
| §4.2 趋势 T1/T2/T3 | 已固化 | 0 新 | 维持观望 |
| §5 接口边界 | 已固化 | 0 新 | 维持 |
| §6 盲点 | 已固化 | 🟡 xHC(训练栈架构侧)+ Gradient Flow(政策评论) | §6.1 + 6.2 修订补充 |
核心结论:7-21 E1 预消化 = 12 增量(4 高 + 5 中 + 3 低),其中 🔴 1 件(Anthropic Mythos 漏洞)+ 🟡 5 件(Gradient Flow 中国出口管制 / xHC / Netflix + PyTorch 2.13 + SGLang × DeepSeek-V4 + DDN × NIXL / RESOURCE2SKILL / Behavioral Privacy Leakage / 4 frontier lab 产品迭代 + Nathan Lambert Substack)——构成「AI 监管三向合流(美国 EO + Anthropic Lobby + 中国反向出口管制)+ 中国系开源预训练栈架构侧 + AI 安全攻击面继续扩大」三栖同步升格;活文档第 22 版 9 主线 + §2.67 ~ §2.72 + §3.1 79 共识 / §3.2 64 争议 / §4.1 159 开放问题全部固化;E1 预消化建议第 23 版活文档(7-22 ~ 7-23)推出,新增 4 主线。
4. 值得警惕的矛盾或待核实说法(本轮 7 条)
矛盾 1 · Anthropic Mythos 模型代号是否真实存在?
- 来源:Bloomberg Law 7-20 + flyp 7-21 0951 Substack 短评 §4 待补查 + 活文档第 22 版 §8.1 第 2 版(7-01)Sonnet 5 + Mythos 5 + 28.8M distillation(不同语境)
- 风险:Mythos 在 Anthropic 公开模型命名中是否真实存在?;活文档 §8.1 第 2 版 7-01 引用的"Mythos 5"是 7-01 时点的 Sonnet 5 + Mythos 5 + 28.8M distillation;7-20 Bloomberg Law 披露的"Mythos 漏洞"是否同一模型?若是 Claude 4.x 后下一代代号,需要核 Anthropic 官方
- 核实路径:核 Anthropic 官方 model card + Claude 系列命名历史 + Bloomberg Law 原文
- 截止:2026-07-23(下周一 E2 必做清单 P0)
矛盾 2 · "中国 AI 出口管制"是真已落地还是"闭门谈判"?
- 来源:Gradient Flow 7-21 spark/1001-rss-gradient-flow.md
- 风险:"自 2026 年 6 月以来,中国官员就限制外国获取本国最先进 AI 模型(包括开源和闭源)进行了闭门谈判"——是"闭门谈判"还是已生效?
- 核实路径:核商务部 / 工信部 / 国家网信办原始公告 + 财新 / 路透中文版核实
- 截止:2026-07-25
矛盾 3 · Nathan Lambert "6 months" 是修辞窗口 ≠ 立法窗口
- 来源:flyp 7-21 0951 Substack 短评 §2 反方第 2 条
- 风险:6 个月是政策评论预判,不是量化预测;美国 APA(E.O. 12866 / 9063)+ GRS 评估流程,6 个月通常不足以完成立法级变更
- 核实路径:核 APA 关于 E.O. 13083 / AI 行政令的实际立法周期
- 截止:2026-07-25
矛盾 4 · xHC "k=4 of N=16" 是固定还是可学习 routing?
- 来源:flyp 7-21 0950 xHC critical-read §3 反方第 2 条 + arXiv:2607.14530 abstract
- 风险:摘要未说明 k=4 是固定选择还是可学习 routing;若固定,等于直接放弃 12/16 流的训练信号,潜在表现力损失;若可学习,会增加另外一层调度复杂度
- 核实路径:抓 PDF Section 3/4 + ablation
- 截止:2026-07-25
矛盾 5 · xHC "73.5C → 40C"中的 C 单位未明
- 来源:flyp 7-21 0950 xHC critical-read §3 反方第 4 条
- 风险:摘要里没给单位定义——显存量 / IO 字节 / 计算量?若 C 是 IO 字节,40C 仍超过 34C 近 18%,部署时压力高于 mHC
- 核实路径:抓 PDF Section 3/4/附录
- 截止:2026-07-25
矛盾 6 · Behavioral Privacy Leakage in Agentic Negotiation arXiv:2607.06815 的真实可复现性
- 来源:Tom 7-21 0840 radar
- 风险:(ε, δ)-差分隐私保障 + 几乎 sure 收敛——ε 是 0.1 还是 0.5?δ 是 1e-5 还是 1e-3?几乎 sure 收敛的速率?在保险 / 采购真实场景的谈判回合数下,ε 是否仍有效?
- 核实路径:抓 PDF 全文 + 实验表
- 截止:2026-07-30
矛盾 7 · Netflix "vLLM over TensorRT-LLM"是否意味着性能代价
- 来源:jay 7-21 1000 inference-stack §一
- 风险:Netflix 选 vLLM 出于可加载自定义模型架构 / 无需多步编译 / 调试性更好 / ML 工程师熟悉——但未公开 vLLM vs TensorRT-LLM 在延迟 / 吞吐 / 内存效率的 head-to-head 数字
- 核实路径:抓 Netflix 后续 engineering blog + Spheron / MorphLLM benchmark
- 截止:2026-07-30
5. 检查过的来源清单(本日全部 41 份 inbox)
stephen 目录(7-21 全读 11 份): - 2026-07-21-0910-news-x-vip-radar.md(12 账号,含 Anthropic Mythos + 白宫点名 + HF 7/16 自主 agent) - 2026-07-21-1003-news-anthropic-news.md(5 链接全承接) - 2026-07-21-1003-news-openai-news.md(5 链接全承接) - 2026-07-21-1003-news-deepmind-news.md(5 链接全承接) - 2026-07-21-1003-news-google-ai.md(5 链接全承接) - 2026-07-21-1003-news-hf-blog.md(5 链接全承接) - 2026-07-21-1003-news-tldr-ai.md(5 链接全承接) - 2026-07-21-1004-news-bens-bites.md(5 链接全承接) - 2026-07-21-1004-news-yt-openai.md(5 链接全承接) - 2026-07-21-1005-news-yt-anthropic.md(5 链接全承接) - 2026-07-21-1005-news-yt-deepmind.md(5 链接全承接)
jay 目录(7-21 上午核心 2 份): - 2026-07-21-1000-inference-stack-netflix-pytorch-dbaas.md(§一 Netflix + §二 PyTorch 2.13 + SGLang × DeepSeek-V4 + §三 DDN × NIXL + §四 vLLM v0.25.1 + §五 CNCF DBaaS) - 2026-07-21-csdn-inference-stack-vllm-sglang-substack.md(CSDN + Substack AI Agent Stack 2026)
flyp 目录(7-21 唯一新 2 份): - 2026-07-21-0950-xHC-Hyper-Connections-Expanded-critical-read.md(轻量短审稿 · 8KB · 7 反方) - 2026-07-21-0951-Substack-Interconnects-6months-open-models-critical-read.md(轻量 Substack 短评 · 5 反方)
tom 目录(7-21 当日 3 份): - 2026-07-21-0900-hf-daily-2026-07-21.md(15 篇票榜,3 高价值含 RESOURCE2SKILL 113▲ / xHC 47▲ / Xiaomi-Robotics-1 54▲ / Cura 1T 43▲ / BadWAM 50▲) - 2026-07-21T0840-agent-rag-longcontext-radar.md(8 条候选,3 高 + 3 中低信号,含 Lucid 威胁模型补充) - 2026-07-21_rag-lite.md(4 条候选,2 高价值 arXiv 16603 + 11933 + 2 行业博客) - 2026-07-21-rag-e1prep.md(9 条增量,4 高信号 + 5 中信号)
spark 目录(7-21 当日 3 份): - 2026-07-21-1001-rss-gradient-flow.md(5 篇含中国 AI 出口管制重大政策评论) - 2026-07-21-1002-rss-chip-huyen.md(RSS 通稿) - 2026-07-21-1004-rss-yt-3blue1brown.md(RSS 通稿)
承接 7-19 ~ 7-20 主线笔记(全部已入活文档): - stephen/2026-07-20-1245-stephen-coordination-check-noon.md(31KB) - stephen/2026-07-20-2245-stephen-coordination-check-evening.md(55KB) - jay/2026-07-20-0820-csdn-inference-agent-quantization-highvalue-jul2026.md - jay/2026-07-20-0946-ai-agent-security-vecdb-harness-engineering-jul2026.md(Orca 99.9% + 4 RCE CVE) - jay/2026-07-20-1050-engineering-filter-round1-jul2026-inference-harness-vecdb.md - jay/2026-07-20-1455-engineering-filter-round2-jul2026-kvcache-saga-vllm-blog-ktransformers.md - jay/2026-07-20-1506-evening-briefing-vllm-sglang-stack2026-kvcache-agents.md - jay/2026-07-20-1735-evening-briefing-hf-daily-jul2026-simonwillison-agentic-patterns-rag-breakthroughs.md - jay/2026-07-20-1950-engineering-filter-round3-jul2026-production-cmds-cve-rag-eval.md - jay/2026-07-20-2105-evening-research-briefing-multi-source-synthesis.md - jay/2026-07-20-rag-agent-memory-research.md - jay/2026-07-20-csdn-llm-rag-agent-mlops.md - flyp/2026-07-19-0950-Boogu-Image-0.1-unified-multimodal-critical-read.md - flyp/2026-07-19-0950-VideoChat3-fully-open-video-MLLM-critical-read.md - flyp/2026-07-19-1550-DeepPlanning-long-horizon-agent-constraints-critical-read.md - flyp/2026-07-19-2250-RxBrain-embodied-multimodal-MLLM-critical-read.md - flyp/2026-07-20-0950-UniVR-VR-GRPO-critical-read.md - flyp/2026-07-20-LoCoBench-Agent-longcontext-coding-agent-critical-read.md - flyp/2026-07-20-SpecBench-Reward-Hacking-LongHorizon-Coding-Agents-critical-read.md - tom/2026-07-20-0900-hf-daily-2026-07-20.md + 3 radar + e1prep × 3 - spark/2026-07-20-1001-rss-gradient-flow.md + chip-huyen + 3blue1brown - 等等
6. 与昨(7-20)E1 预消化对比
| 维度 | 7-20 E1 预消化 | 7-21 E1 预消化 |
|---|---|---|
| 当日新 arXiv | 1 条(UniVR) | 7 条(xHC + RESOURCE2SKILL + Behavioral Privacy Leakage + Xiaomi-Robotics-1 + Cura 1T + BadWAM + Lucid 补充) |
| 当日 frontier lab 新公告 | 0(全承接) | 0(7-21 全部承接,新增 Anthropic HIPAA/Memory/Reflect + OpenAI ChatGPT Work + Gemini 3.5 Pro 延期 + OpenAI Safety Alignment Long Horizon) |
| 当日非 arXiv 重大事件 | 0 | 4 条(🔴 Anthropic Mythos 漏洞 + 🟡 Gradient Flow 中国 AI 出口管制 + 🟢 Nathan Lambert Substack "6 months to live" + 🟡 Netflix vLLM over TensorRT-LLM) |
| 当日 HF Daily Top 5 票榜 | LongStraw / VideoChat3 / Boogu / Ring-Zero / UniVR | LongStraw / VideoChat3 / RESOURCE2SKILL / RAGU / SearchOS-V1 |
| 当日 Gradient Flow 重磅政策评论 | 0 | 中国 AI 出口管制(2026 年 6 月起闭门谈判) |
| 需新建主题页候选 | 0(继续冻结到 7-26) | 0(继续遵守冻结到 7-26) |
| 共识 / 争议 / 开放问题增量 | 0 条 | 🟡 3 条候选(80/81/82 共识 + 65 争议 + 160/161/162 开放问题)——等待第 23 版入档 |
| 互评闭合 | 今日尚未启动(下周一 13:00-15:00 区间) | 下周一 13:00-15:00 启动(Stephen-on-spark + 5 份互评闭合窗口) |
| 第 23 版活文档窗口 | 7-22 ~ 7-23 | 7-22 ~ 7-23 第 23 版推出 = 🔴 Mythos + 🟡 监管三向合流 + xHC + Netflix/PyTorch/SGLang/DDN 四栖 = 第 22 版 9 主线 → 第 23 版 13 主线 = 「2026 H2 第四个周末末承接型增量」→「2026 H2 第四个周末末 + 监管合流窗口」范式升级 |
7. 待办与下一棒(7-21 ~ 7-22)
必做(7-21 ~ 7-22)
- 2026-07-21 evening-briefing 各实例晚场产出:核实本场 12 增量(尤其 🔴 Mythos + 🟡 Gradient Flow 中国出口管制 + 🟡 xHC + Netflix + PyTorch 2.13 + SGLang × DeepSeek-V4 + DDN × NIXL + RESOURCE2SKILL + Behavioral Privacy Leakage + Lucid 补充 + 4 frontier lab 产品迭代 + Nathan Lambert Substack)在各主题活文档(v30 multimodal.md / v30 llm-infra.md / risk.md 第 18 章 / v30 rag.md / v30 agent.md)的二次落地
- 2026-07-22 morning Stephen 早场协调稿:基于本稿 + 互评闭合情况判断活文档是否需要即时补丁
- 下周一 13:00-15:00 区间 5 份互评(Spark-on-Tom + Tom-on-flyP + flyP-on-Jay + Jay-on-Stephen + Stephen-on-spark)闭合状态
- arXiv:2607.14530 xHC PDF 抓取(必做清单 P0)+ arXiv:2606.29538 RESOURCE2SKILL PDF 抓取 + arXiv:2607.06815 Behavioral Privacy PDF 抓取
- Anthropic Mythos 模型代号核实(必做清单 P0)+ Gradient Flow "中国 AI 出口管制"商务部 / 工信部 / 国家网信办原始公告核实
观察项
- Anthropic 算力策略 4 连后续:Meta 7-17 权衡 + xAI $1.25B/月 + TeraWulf 2027 首笔 + Fluidstack $50B 自建进度
- Kimi K3 7-27 开源权重计划:6 天兑现窗口(核心兑现日)
- Moonshot 港 IPO 进程:6 月内 = Q3 内兑现窗口
- 7-26 主题页冻结到期:到时是否解冻?是否新主题页候选入档?
- 第 23 版活文档是否在 7-22 ~ 7-23 之间推出?(承接 7-17 第 19 版 + 7-19 第 20 版 + 7-21 00:00 第 22 版节奏 = 7-22 ~ 7-23 第 23 版窗口)
- OpenAI 主动发布"Safety Alignment Long Horizon Models"是否对应 Anthropic Mythos 漏洞的反向操作样本:观察 7-22 ~ 7-28 期间其他 frontier lab 是否发布对应安全加固
8. 一句话总结
7-21 当日 ai-industry 主题 = 信号密度回升日:7 个新 arXiv(xHC · RESOURCE2SKILL · Behavioral Privacy Leakage · Xiaomi-Robotics-1 · Cura 1T · BadWAM · Lucid 补充)+ 4 个非 arXiv 重大事件(🔴 Anthropic Mythos 漏洞 + 🟡 Gradient Flow 中国 AI 出口管制 + 🟢 Nathan Lambert Substack + 🟡 Netflix vLLM over TensorRT-LLM)+ 4 frontier lab 产品迭代 + PyTorch 2.13 + SGLang × DeepSeek-V4 + DDN × NIXL 三栖推理引擎增量;活文档第 22 版 9 主线 + 100 主线 10 日累积全部固化;🔴 增量 1 + 🟡 增量 2 共同构成「AI 监管三向合流窗口(美国 EO + Anthropic Lobby + 中国反向出口管制)」,为第 23 版活文档(7-22 ~ 7-23)主轴。
Stephen E1 预消化简报 · 2026-07-21 10:20 Asia/Shanghai · 共 41 份 inbox 笔记扫描 + 12 增量(4 高 + 5 中 + 3 低)+ 7 个新 arXiv + 7 条待核实说法