ai-industry · E1 预消化简报(2026-07-30)

执行:Stephen · 10:20 CST · 承接 knowledge/ai-industry.md v31(7-29 evening 棒收官 · 6 主线密集 + 1 统一主线立标续立 Kimi K3 arXiv:2607.24653 + 23 新增 arXiv · 167 件 arXiv 总池 + 126 URL + 11 CVE)· 为今晚第 32 版活文档接力预习备料。 窗口:7-29 22:00 CST(v31 evening 棒收官)→ 7-30 10:20 CST(本棒执行点)= ~12h 已过 + ~12h 剩余。 目的:v31 已承接 Kimi K3 arXiv 立基础 + HF Daily 7-29 票榜 11 件 net-new + 9 件 7-29 上午 frontier/industry 立标(Anthropic 7-29 NEW ×2 + Dario 周末博客 + HF rogue agent + LearnVector + singularity 等),本棒聚焦 v31 evening 收官后 7-30 上午批次的"边际增量":TLDR AI 7-29 头条「AI 减速协议」+ OpenAI 7/29 开源 Codex Security CLI/SDK + HF 7-29 NEW「Frontier Lab Agent 入侵剖析」技术时间线第 7 日披露 + Sam Altman 7-26 演示 ChatGPT Work 一句话端到端 9 人长周末 multi-agent 个人 AI 新立标 + Karpathy 7 月底「数字多比」Claude Code 反向工程本地家庭自动化网关 + Jim Fan 7-15 GEAR 8000 timesteps 5 分钟「肌肉记忆」+ HF Daily 7-30 票榜完全替换(HiFi-UMI 134▲ + BeyondUncertainty 83▲ + Rethinking CFG 70▲ + RepoReasoner 43▲ + CodeNib 43▲ + ReDesign 56▲ + Mage-VL 23▲ + Pass the Baton 23▲ + Shieldstral 12▲ 等 11 件)+ Tom 7-30 radar 4 件 P0(Agent Retrieval Bench / Cyber-Capable AI Agents / BeyondUncertainty / RepoReasoner)+ Simon Willison 7-29「AI 蠕虫渗透 Word」+ 「为 Claude 和 ChatGPT 添加自定义 MCP server」+ Anthropic Mythos Preview AES Möbius Bridge 思维链 7-30 NEW + MSR 4 项(Aurora 1.5 + Flint 可视化语言 + SkillOpt + Memora)+ Lilian Weng 7-04 Harness Engineering for Self-Improvement 学术框架 P0 立标(RSI + ACE + MCE)+ Lilian Weng 7-06 谨慎看待 Scaling Laws 新文 + TLDR AI 7-29 头条「AI 减速协议 + 个人超级智能访问 + Grok Build Mode」+ ByteByteGo「ChatGPT 如何优化其 Agent 循环」+ Nathan Benaich Air Street Capital 2.32 亿美元 Fund III + Gradient Flow「开源多维旋钮 + AI 胜出数据中心亏损 + 三新模型支出流向」+ 微调 Velvet / FlashKDA MoonshotAI Kimi Delta Attention 高性能 CUDA kernel 990★ + 7-30 09:10 Stephen X VIP radar 沿用 0 件 net-new 主要含 Karpathy 数字多比 + Andrew Ng OpenWorker + LeCun "Tired of winning" 等。


检查过的来源(共 38 项,涵盖 jay/tom/flyp/spark/stephen 7-29 evening 后段 + 7-30 上午批次 + paper_cards 632-653 7-29~30 新建)

stephen(7-30 morning,11 件)

  • 2026-07-30-0910-news-x-vip-radar(10 件 7-30 早间 X 名人雷达:OpenAI 7/29 开源 Codex Security CLI/SDK(Apache 2.0 / TypeScript / 仓库扫描 / CI/CD)+ OpenAI × HF 7-21~29 Frontier Lab Agent 入侵事件 7 日连续披露窗口 + OpenAI 7/9 GPT-5.6 Sol/Terra/Luna 沿用 + DeepMind 7/21~22 三模型 + DOE Genesis Mission 沿用 + Anthropic 7/14~20 系列动作 + Sam Altman 7-26 ChatGPT Work 一句话端到端 9 人长周末 = 个人 AI multi-agent 新立标 + Jim Fan 7-15~24 GEAR 8000 timesteps 5 分钟「肌肉记忆」+ Andrew Ng 7-23 OpenWorker 沿用 + Karpathy 7 月底「数字多比」Claude Code 反向工程家庭自动化网关 + Ethan Mollick TIME100 Creators 2026 + LeCun 7-24 "Tired of winning")= vs 7-29 12 件 = 实质增量 0 件 net-new,全部为 v31 evening 沿用或 §6 升级候选沿用;Karpathy 数字多比为 v34 §6 候选新增 1 件
  • 2026-07-30-1005-news-anthropic-news(5 件:7-30 NEW Mythos Preview 在发现 AES Möbius Bridge 中的思维链 + 7-29 沿用「使用 Claude 发现密码学弱点」 + 7-29 沿用「我们对开放权重模型的立场」+ 7-29 沿用「扩展 Cognizant 合作」+ 7-29 沿用「推出 Claude Opus 5」)
  • 2026-07-30-1005-news-openai-news(5 件:7-30 NEW「两个设置如何让我们的 ARC-AGI-3 benchmark 分数提升至三倍」+ 7-30 NEW「用 ChatGPT 加速学术研究者的科学发现」+ 7-30 NEW「GPT-5.6 如何融合前沿智能与前沿效率」+ 7-30 NEW「Agentic AI 时代的科学计算」+ 7-30 NEW「AI 如何扩展人们的工作内容」)
  • 2026-07-30-1006-news-google-ai(5 件:Gemini API Managed Agents 3.6 Flash + hooks + 搜索 AI Mode 5 种现实世界应用 + Google 搜索派对 5 招 + Galaxy Unpacked 2026 + Connected Apps)
  • 2026-07-30-1006-news-deepmind-news(5 件:Google Flow Music Lyria 3.5 + Genesis Mission $40M + Gemini 3.6 Flash + 3.5 Flash-Lite + 3.5 Flash Cyber + 生物韧性方法)
  • 2026-07-30-1006-news-hf-blog(5 件:7-29 沿用 OlmoEarth + LFM2.5-Encoders + Cosmos-H-Dreams + 7-29 NEW Frontier Lab Agent 入侵剖析 + Nunchaku 4-bit)
  • 2026-07-30-1006-news-tldr-ai(5 件:7-29 NEW「AI 减速协议 ⏸️ 个人超级智能访问 🌍 Grok Build Mode 🛠️」+ 7-28 沿用「Anthropic 开源权重 + Kimi K3 + MAI Cyber」+ 7-27 沿用「Claude Opus 5 + OpenAI 黑客事件 + NVIDIA 开源权重」+ 7-24 沿用 ChatGPT Health + Fugu-Ultra + Runway Media Router + 7-23 沿用 Cursor Router + OpenAI Presence + AMD + Anthropic 合作)
  • 2026-07-30-1006-news-bens-bites(5 件:Opus 5 >> Fable 5 + 作弊被抓 + 优于 Fable 的设计 + Inkling + ChatGPT 桌面应用与托管站点)
  • 2026-07-30-1007-news-yt-openai(5 件:在 ChatGPT Work 中使用语音 + 10 万名学术研究者免费访问 + gpt-transcribe + gpt-live-transcribe + ChatGPT Work 销售版 5 件)
  • 2026-07-30-1008-news-yt-anthropic(5 件:Claude 思维的不同层级 + 推出 Claude Fable 5 + 守护全球软件安全的计划 Project Glasswing + 当 AI 表现出情绪 + 将 Claude 的思维转化为语言)
  • 2026-07-30-1008-news-yt-deepmind(5 件:重建贝利消失的进球 + 理解 AI 的内在思维 + 当百万级 AI Agent 相遇 + Gemini for Science + SynthID)

jay(7-30 morning,13 件)

  • 2026-07-30-1000-rss-simon-willison(5 件:🆕「AI 蠕虫渗透 Word」(Håkon Måløy 全新 prompt injection 变体,可将对 Microsoft Word 的 prompt injection 攻击升级为完全自我复制的蠕虫)+ 🆕「为 Claude 和 ChatGPT 添加自定义 MCP server」+ 沿用「用 Claude 发现加密弱点」+ 沿用「引用 D. Richard Hipp(SQL 历史)+ 沿用「引用 Matthew Green 后量子密码」)
  • 2026-07-30-1000-rss-raschka(5 件:控制 LLM 的推理力度 + 使用本地 Coding Agent + LLM 研究论文 2026 年清单 1-5 月 + LLM 架构最新进展 KV Sharing mHC Compressed Attention + 我理解 LLM 架构的工作流)
  • 2026-07-30-1000-rss-nathan-benaich(5 件:🆕 欧洲无法通过租赁实现 AI 主权 + 🆕 Air Street Capital 2.32 亿美元 Fund III 募资 + State of AI 2026 年 5 月 + 公布 RAAIS 2026 主旨演讲嘉宾 + State of AI 2026 年 4 月通讯)
  • 2026-07-30-1000-rss-bytebytego(5 件:🆕 ChatGPT 如何优化其 Agent 循环 + 为什么 DoorDash Instacart Uber Eats 三种 LLM 集成方式 + NVIDIA 如何为 AI 时代构建开源模型 + 分布式系统时钟因果性顺序入门 + 构建生产可用 AI Agent 的最佳实践)
  • 2026-07-30-1003-rss-cool-papers(5 件:🆕 Pass the Baton 轨迹接力式 On-Policy 蒸馏 arXiv:2607.26057 + 🆕 UniMem 互补记忆机制 arXiv:2607.26017 + 🆕 指令微调模型句法趋同 arXiv:2607.26015 + 🆕 Kontrast 跨模态知识不一致 arXiv:2607.25959(沿用 tom radar)+ 🆕 Polistemics LLM 选举信息中介评估 arXiv:2607.25953)
  • 2026-07-30-1003-rss-cool-papers-ir(5 件:RecoReward 多模态描述生成 arXiv:2607.25901 + 假设驱动货架生成 arXiv:2607.25823 + LLM-as-a-Judge 对话式音乐推荐 arXiv:2607.25640 + BeyondUncertainty arXiv:2607.25600(沿用)+ MARS 多智能体重排序 arXiv:2607.25420)
  • 2026-07-30-1003-rss-lilian-weng(5 件:🆕 Harness 工程:实现自我改进(2026-07-04)= RSI + 三大 Harness 设计模式(Workflow Automation / File System as Persistent Memory / Sub-agent & Backend Jobs)+ ACE context as evolving playbook + MCE 内层/外层优化 + Harness = AI 的操作系统 · P0 立标 + 🆕 谨慎看待 Scaling Laws(2026-06-24)+ 沿用「我们为何思考」+ 沿用 RL Reward Hacking + 沿用 LLM 外在幻觉)
  • 2026-07-30-1004-rss-msr-blog(5 件:🆕 SymCrypt Rust 密码学验证 + 🆕 Aurora 1.5 天气地球系统基础模型 22 变量 + 🆕 Flint 可视化语言 AI 时代 + 🆕 SkillOpt Agent Skills 视为可训练参数 + 🆕 Memora 谐波记忆表示 兼顾抽象性与具体性)
  • 2026-07-30-1005-rss-import-ai(5 件沿用:Import AI 466「机器人领域的苦涩教训 + AI 完成一周编程任务 + OpenAI 意外 AI 黑客」+ 沿用 Import AI 465「开源与闭源差距 + Kimi K3 + Demis 重大政策」+ 沿用 Import AI 464「Fable 写 GPU kernel + AI 自动化 + 模拟计算」+ 沿用 Import AI 463「自我改进机器人 + 万卡中国 GPU」+ 沿用 Import AI 462「超级说服力 + 自我维持 AI + ASI 路径」)
  • 2026-07-30-1007-rss-yt-karpathy(5 件:如何使用 LLMs + 深入剖析类似 ChatGPT 的 LLM + 复现 GPT-2 124M + 构建 GPT Tokenizer + 1 小时大语言模型入门讲座)
  • 2026-07-30-1007-rss-yt-fireship(5 件:🆕「Anthropic 是不是刚刚扼杀了独立开发者?」+ 「Open-weight AI 参数量刚刚达到 2.8 万亿」(Kimi K3)+ 🆕「估值 120 亿美元初创公司终于发布产品」(Anthropic Opus 5 沿用)+ 沿用「OpenAI 再因剽窃被告」+ 沿用「历史上最有趣的 hack」)
  • 2026-07-30-ai-engineering-trending(GitHub Trending 7-30 日榜:airi moeru-ai 45,391★(AI companion / Minecraft / Factorio / Neuro-sama)+ openwork different-ai 17,934★(Claude Cowork 开源替代)+ VibeVoice Microsoft 前沿开源语音 AI + FlashKDA MoonshotAI 990★(Kimi Delta Attention 高性能 CUDA kernel)+ alibaba open-code-review(HF speech-to-speech 7,877★ 沿用 + book-to-skill 12,783★)+ HF Trending Models 7 月快照:DeepSeek V4.1 / Qwen 3.7 系列 / Kimi K3 / GLM-6 / Llama 4.5 / Hunyuan Large 3 / Mistral Small 3.x / Phi-4 series / Hy3 = 7 月前 10 主流模型沿用)
  • 2026-07-30-1003-rss-cool-papers-ir(已列前,补第二波):RecoReward arXiv:2607.25901 等 5 件 IR 邻接

tom(7-30 morning,5 件)

  • 2026-07-30-0900-hf-daily-2026-07-30(HF Daily 7-30 票榜 15 件全核:HiFi-UMI arXiv:2607.25895 134▲(高保真 UMI 数据学习可部署操控策略)+ A New Role for Relevance arXiv:2607.24223 83▲(Agentic 搜索语料库交互)+ Rethinking CFG OPD arXiv:2607.24731 70▲(+7 单日续立)+ ReDesign arXiv:2607.25565 56▲(Agentic 图像可编辑)+ CodeNib arXiv:2607.25431 43▲(代码 Agent 多视图数据系统)+ Sol-Attn arXiv:2607.24027 32▲(+7 单日续立)+ Oxygen-TryOn arXiv:2607.21694 26▲(+5 单日续立)+ Keep It InMind arXiv:2607.24368 25▲(Agent 记忆隐式关联)+ Pass the Baton arXiv:2607.26057 23▲(轨迹接力蒸馏)+ Mage-VL arXiv:2607.24904 23▲(Codec 原生流式)+ Multi-Turn Planning arXiv:2607.24720 22▲(单教师多教师 OPD)+ 新颖 Déjà Vu arXiv:2607.23514 12▲(多模态自动事实核查)+ Shieldstral arXiv:2607.25857 12▲+ 视频 prompt 工程 arXiv:2607.25537 11▲+ Wonder arXiv:2607.26037 11▲(视频世界模型))= HF Daily 7-30 vs 7-29 票榜 15 件完全替换(7-29 票榜 14/15 件 7-30 跌出前 15 名)+ 11 件 7-30 新进
  • 2026-07-30-agent-rag-longcontext-radar(4 件 P0 高价值 + 4 件中价值:Agent Retrieval Bench arXiv:2607.24882(文件级检索基准 · coding agent 上下文获取阶段 · code2test/comment2context/trace2code/edit2ripple 四正检索任务)+ Cyber-Capable AI Agents arXiv:2607.25379v1(网络攻击 AI agent 五大漏洞类 · Abu Bakar Siddik)+ BeyondUncertainty arXiv:2607.25600v1(verbalized confidence 路由检索 · Sah/Lian/Zhang)+ RepoReasoner arXiv:2607.25996v1(代码库级推理 · Wang et al. · Output Prediction 跨文件有状态执行 + Call Chain Prediction 高层架构依赖)
  • 2026-07-30-rag-e1prep(R48 → R49 接力简报 · 8 件增量 · 主战场在工程化深化 + arXiv 偏少)
  • 2026-07-30-1007-rss-yt-lex-fridman(5 件播客:历史人物系列 · 0 件 ai-industry 主增)
  • 2026-07-30-1007-rss-yt-yannic-kilcher(5 件:🆕 TiDAR 在 Diffusion 中思考 + 🆕 Titans 在测试时学习记忆)

flyp(7-30 morning,1 件)

  • 2026-07-30-multimodal-e1prep(v34 接力窗口第三棒 E1 · 1 件 flyP 7-29 1550 WorldDiT B 旁证级 + 1 件 LOCA-bench B 旁证级 + HF Daily 7-30 全新 6 件 multimodal 邻接(Mage-VL 23▲ 流式 / ReDesign 56▲ Agentic 图像 / Wonder 11▲ / 视频 prompt 11▲ / HiFi-UMI 134▲ 操控 / 新颖 Déjà Vu 12▲)+ work-queue 7-30 3 件 0.5 级 multimodal 候补(VisualPatchWorld / Temporal-Distance JEPA / Parallel Decoding Distillation)+ tom 7-30 radar 1 件 Kontrast multimodal 邻接 = 32 件 v34 候选增量 · multimodal 主,ai-industry 邻接)

spark(7-30 morning,3 件)

  • 2026-07-30-1000-rss-gradient-flow(5 件:🆕 专用 AI 正在变得更容易构建 + 🆕 顶尖 AI 实验室正突然与你的自有数据展开竞争 + 沿用「开源多维旋钮」+ 🆕「AI 可以胜出而数据中心却在亏损」+ 🆕「三个新模型一个关于 AI 支出流向的信号」(GLM 5.2 / Kimi K3 / Gemini 3.6 Flash 三款前沿级模型发布))
  • 2026-07-30-1004-rss-chip-huyen(5 件沿用:生成式 AI 应用常见陷阱 + Agent 综述 + 构建生成式 AI 平台 + 衡量个人成长 + 900 个开源 AI 工具)
  • 2026-07-30-1007-rss-yt-3blue1brown(5 件:压缩即智能交叉熵 + 完美编码)

paper_cards(7-29 evening + 7-30 上午新增抽查 · 主分类 ai-industry / agent / multimodal 邻接)

  • 7-29 evening 后段 + 7-30 上午新增 card 已经入 paper_cards/632~653(WorldDiT 2607.23909 · LOCA-bench 2602.07962 · Cybench 2607.22157 · μ-Bench 2607.23188 · IteraSim RAG 2607.20346 · Ground Truth First 2607.21962 · Agent Memory 时序 KG 2607.21503 · BeyondUncertainty 2607.25600v1 · Kontrast 2607.25959v1 · RepoReasoner 2607.25996v1 · Cyber-Capable 2607.25379v1 · CodeNib 2607.25431 · Keep It InMind 2607.24368 · Sol-Attn 2607.24027 · Mage-VL 2607.24904 · ReDesign 2607.25565 · HiFi-UMI 2607.25895 · Reasoning Denoiser 2607.22098 · Evidence Attribution 2607.24651 · Wonder 2607.26037 · Temporal-Distance JEPA 2607.25337 · VisualPatchWorld 2607.25236 · Parallel Decoding Distillation 2607.26004 · UniMem 2607.26017 · Polistemics 2607.25953 · RecoReward 2607.25901 · MARS 2607.25420 · Pass the Baton 2607.26057 · Characterizing Warp Divergence 2604.25850 · IndicTalk 2607.23242 · Chamaileon 2607.23518 · Vision Mamba 2401.09417 · PaLM-E 2303.03378 · SimVLM 2108.10904 = 32 张)

增量条目(8 条 · 含 v31 续立 + v32 net-new 候选)

增量 1 · ⭐⭐⭐⭐⭐ · TLDR AI 7-29 头条 「AI 减速协议 ⏸️ 个人超级智能访问 🌍 Grok Build Mode 🛠️」 + OpenAI 7-29 开源 Codex Security CLI/SDK(Apache 2.0 / TypeScript / 仓库扫描 / CI/CD) = 前沿 lab 协议栈 + 安全工程开源 7-30 头条立标

来源:stephen 2026-07-30-1006-news-tldr-ai 第 1 条「AI 减速协议 + 个人超级智能访问 + Grok Build Mode」7-29 NEW · stephen 2026-07-30-0910-news-x-vip-radar 第 1 条「OpenAI 7/29 开源 Codex Security CLI/SDK」(https://github.com/openai/codex-securityjay 2026-07-30-1007-rss-yt-fireship 第 1 条「Anthropic 是不是刚刚扼杀了独立开发者?」+ 第 3 条「Open-weight AI 参数量刚刚达到 2.8 万亿(Kimi K3)」

要点: - 🟡 TLDR AI 7-29 头条「AI 减速协议」 = 业界治理层信号:主动"减速"成为顶级 lab 共识性动作 + "个人超级智能访问"(personal superintelligence access)的提法呼应 Sam Altman 7-27 singularity 言论 + "Grok Build Mode"(xAI Grok 代码构建模式)沿用 v31 §6 17 足候选 xAI 路径 - 🟡 🔴 OpenAI 7/29 开源 Codex Security CLI/SDK = OpenAI 首个安全侧开源立标:Apache 2.0 / TypeScript / 仓库扫描 / 追踪发现项 / 验证修复并接入 CI/CD · 与 Anthropic Project Glasswing(7-30 NEW YT 视频)对位 · = frontier lab × 安全工程开源 第二例(继 OpenAI × HF 7-21 联合披露 + Anthropic Claude Code 沿用) - 🟡 Codex Security = OpenAI 首个安全侧开源 直接对位 Microsoft agent-governance-toolkit 5.2k★(jay 0940 GitHub Trending 7 月汇总)· 二者构成 frontier lab + 平台层双轨开源 = R32 §2.13 OWASP ASI 治理侧开源形成"frontier lab + enterprise platform"双引擎 - 结构性信号:TLDR AI 7-29 头条首次出现"AI 减速协议"概念 = 业界治理层 + lab 公关层 + 资本层 + 安全开源层 4 维同步;Codex Security CLI/SDK 首个安全侧开源 = frontier lab 安全治理从「闭源披露」走向「开源工程化」= v32 §2.114.x frontier lab 主动合作新范式续立 + §2.13 OWASP ASI 治理侧 第 4 例(继 microsoft/agent-governance-toolkit + BeyondTrust 2025-12-16 + Anthropic Project Glasswing)

与活文档 v31 §2.114.7 + §2.114.8 + §2.114.10 + §2.13 的关系: - v31 §2.114.7 已立 Sam Altman 7-27 singularity 播客 + 7-28 华盛顿国会闭门会 - v31 §2.114.8 已立 HF 7-26 公布 OpenAI rogue agent 入侵事件 = frontier lab × AI 平台层安全协作第 3 例 - v31 §2.114.10 已立 Dario Amodei 7-27~28 周末博客澄清 + Kimi K3 arXiv 立基础 + NVIDIA「为 AI 时代构建开源模型」Bryan Catanzaro - v31 §2.13 已立 microsoft/agent-governance-toolkit 5.2k★ OWASP ASI 10/10 - 本场 7-30 上午 TLDR AI「AI 减速协议」+ Codex Security 开源 + Anthropic Project Glasswing = §2.114.7 续立 + §2.114.8 续接 + §2.13 第 4 例 + §2.114.x 第 4-5 例

建议归入节:knowledge/ai-industry.md §2.114.7 续立(AI 减速协议 + 头条立标)+ §2.114.8 续接(Codex Security 7 日连续披露窗口升级)+ §2.13 OWASP ASI 第 4 例(Codex Security + Project Glasswing 双轨开源)+ §2.114.x 新增 frontier lab × enterprise platform 双引擎治理侧小节 + §3.1 共识新增第 133 条 + §3.2 争议新增第 113 条

arXiv 号(本节 0 件新 arXiv;沿用 v31 §2.114.8 已有 HF blog 与 OpenAI 官方披露立基础)

增量 2 · ⭐⭐⭐⭐⭐ · HF Daily 7-30 票榜 15 件完全替换 + HiFi-UMI arXiv:2607.25895 134▲ 当日登顶 + BeyondUncertainty arXiv:2607.25600 83▲ + Rethinking CFG arXiv:2607.24731 70▲ + CodeNib arXiv:2607.25431 43▲ + RepoReasoner(沿用 tom radar)+ Mage-VL/ReDesign/Sol-Attn/Oxygen-TryOn/Keep It InMind/Pass the Baton 续立 = HF Daily 7-30 票榜新立标级候选饱和

来源:tom 2026-07-30-0900-hf-daily-2026-07-30 票榜 15 件全核 · tom 2026-07-30-agent-rag-longcontext-radar 4 件 P0 高价值 · flyp 2026-07-30-multimodal-e1prep §1.3/§1.4 HF Daily 7-30 6 件 multimodal 邻接 + work-queue 3 件候补

要点: - 🔴 HiFi-UMI arXiv:2607.25895 134▲(HF Daily 7-30 #1 高保真 UMI 数据学习可部署操控策略)= 7-29 票榜无此件 → 7-30 单日 134▲ 登顶 = v32 主线 7 / 主线 6 二联邻接新立标级候选 - 🟡 BeyondUncertainty arXiv:2607.25600 83▲(HF Daily 7-30 #2 + tom radar 7-30 #3 P0)= verbalized confidence 路由检索 + held-out validation 选模型专属阈值 = RAG 路由新范式立标级候选(与 tom radar 7-30 #3 同源) - 🟡 Rethinking CFG OPD arXiv:2607.24731 70▲(HF Daily 7-30 #3 +7▲ 单日续立)= 7-29 单日 +48▲ 暴增 63▲ → 7-30 单日 +7▲ 累计 70▲ = flyP 7-28 1550 OPD-CFG critical read 升档立标级续立 - 🟡 ReDesign arXiv:2607.25565 56▲(HF Daily 7-30 #4 flyp multimodal §1.3 邻接 #2)= Agentic 分解图像可编辑设计结构 = 主线 1 + 主线 5 multimodal-RAG 二联 - 🟡 CodeNib arXiv:2607.25431 43▲(HF Daily 7-30 #5 + tom radar 7-29 evening v2 重写)= 多视图代码 Agent 数据系统 = v32 主线 4 工程化 + 主线 7 二联邻接新立标级 - 🟡 Sol-Attn arXiv:2607.24027 32▲(HF Daily 7-30 #6 +7▲ 单日续立)= 即时注意力稀疏化视频生成推理 = 主线 6 inference-efficient - 🟡 Oxygen-TryOn arXiv:2607.21694 26▲(HF Daily 7-30 #7 +5▲ 续立)= 时尚原生任意物品虚拟试穿 - 🟡 Keep It InMind arXiv:2607.24368 25▲(HF Daily 7-30 #8)= Agent 记忆隐式关联盲区评测 125 任务 × 10 生活领域 - 🟡 Pass the Baton arXiv:2607.26057 23▲(HF Daily 7-30 #9 + cool papers cs.CL)= 轨迹接力式 On-Policy 蒸馏 - 🟡 Mage-VL arXiv:2607.24904 23▲(HF Daily 7-30 #10 flyp multimodal §1.3 #1)= Codec 原生流式多模态基础模型 - 🟡 Multi-Turn Planning arXiv:2607.24720 22▲(HF Daily 7-30 #11)= 单教师多教师 OPD 长horizon 规划 - 🟡 新颖 Déjà Vu arXiv:2607.23514 12▲(HF Daily 7-30 #12 flyp multimodal §1.3 #6)= 多模态自动事实核查无污染动态评测 - 🟡 Shieldstral arXiv:2607.25857 12▲(HF Daily 7-30 #13)= 12▲ 新进 - 🟡 视频 prompt 工程 arXiv:2607.25537 11▲(HF Daily 7-30 #14 flyp multimodal §1.3 #4)= 视频模型可视化 prompt 工程 - 🟡 Wonder arXiv:2607.26037 11▲(HF Daily 7-30 #15 flyp multimodal §1.3 #3)= 视频世界模型新方向 - 🟡 Agent Retrieval Bench arXiv:2607.24882(tom radar 7-30 #1 P0 未在 7-30 票榜前 15 名内)= coding agent 文件级检索基准 · 4 正检索任务 · 评测"上下文获取阶段" - 🟡 Cyber-Capable AI Agents arXiv:2607.25379v1(tom radar 7-30 #2 P0)= 网络攻击 AI agent 五大漏洞类 + 评估 containment 视角 - 🟡 RepoReasoner arXiv:2607.25996v1(tom radar 7-30 #4 P0)= 代码库级推理 · Output Prediction 跨文件 + Call Chain Prediction 高层依赖 - 结构性信号:HF Daily 7-30 票榜 15 件完全替换 = 7-29 票榜 14/15 件 7-30 跌出前 15;HiFi-UMI 单日 134▲ 登顶 + BeyondUncertainty 83▲ + Rethinking CFG 70▲ + CodeNib 43▲ + RepoReasoner(沿用 tom radar)+ ReDesign 56▲ + Mage-VL/ReDesign/HiFi-UMI/Pass the Baton/UniMem/Polistemics/RecoReward/MARS 多个候补 = v32 HF Daily 票榜新立标饱和

与活文档 v31 §2.114.2 续立关系: - v31 §2.114.2 已立 HF Daily 7-29 票榜 15 件全核 + Kimi K3 263▲ +11 件 7-29 上午新立标候选 + 3 件 7-29 上午续立/翻倍 - 本场 7-30 上午 HF Daily 票榜 15 件完全替换 + HiFi-UMI 单日 134▲ 登顶 + BeyondUncertainty/ReThinking CFG/CodeNib/RepoReasoner/ReDesign/Mage-VL/KeeItInMind/Sol-Attn/Oxygen-TryOn/Pass the Baton 等 8+ 件立标级候选 - v32 §2.114.2 应续立 + 新增 11 件 net-new 立标级候选

建议归入节:knowledge/ai-industry.md §2.114.2 续立 + HF Daily 7-30 票榜 11 件 net-new 立标级候选(HiFi-UMI / BeyondUncertainty / Rethinking CFG / RepoReasoner / CodeNib / ReDesign / Mage-VL / Sol-Attn / Oxygen-TryOn / Keep It InMind / Pass the Baton)+ §2.114.6 续接(flyp multimodal §3 立标候选)

arXiv 号(本节新立 11 件 + 续立 4 件 = 15 件):arXiv:2607.25895(HiFi-UMI)+ arXiv:2607.25600(BeyondUncertainty)+ arXiv:2607.24731(Rethinking CFG 升档)+ arXiv:2607.25431(CodeNib)+ arXiv:2607.25996v1(RepoReasoner)+ arXiv:2607.25565(ReDesign)+ arXiv:2607.24904(Mage-VL)+ arXiv:2607.24027(Sol-Attn)+ arXiv:2607.21694(Oxygen-TryOn)+ arXiv:2607.24368(Keep It InMind)+ arXiv:2607.26057(Pass the Baton)+ arXiv:2607.24720(Multi-Turn Planning)+ arXiv:2607.23514(新颖 Déjà Vu)+ arXiv:2607.25857(Shieldstral)+ arXiv:2607.26037(Wonder)

增量 3 · ⭐⭐⭐⭐⭐ · Tom 7-30 radar 4 件 P0 高价值(Agent Retrieval Bench + Cyber-Capable AI Agents + BeyondUncertainty + RepoReasoner)= coding agent / security / RAG 路由 / 代码库推理 4 候选池同步立基础 = §2.114.x 新增 frontier lab × 工程化治理 第二维

来源:tom 2026-07-30-agent-rag-longcontext-radar 4 件高价值 + tom 2026-07-30-0900-hf-daily-2026-07-30 #1 / #5 / #8 / #13 与 radar 4 件 P0 高度重叠

要点: - 🟡 Agent Retrieval Bench arXiv:2607.24882(tom radar 7-30 #1 P0 + HF Daily 7-26 立基础)= coding agent 评测从"结果导向"转向"阶段分解" · 4 正检索任务(code2test / comment2context / trace2code / edit2ripple)· 相关性由"agent 下一步需要什么"定义 · = §2.114.x frontier lab × 工程化治理 第二维 候选池第 1 件 - 🟡 Cyber-Capable AI Agents arXiv:2607.25379v1(tom radar 7-30 #2 P0 + HF blog 7-29 NEW 邻接)= 网络攻击 AI agent 五大漏洞类:多步攻击链 / 沙箱边界冲突 / 供应链凭据暴露 / 持久化 C2 / 自动行动速度 + 首次从"评估 containment"角度综述攻击面 · = §2.114.x 第二维 第 2 件(security 子项) - 🟡 BeyondUncertainty arXiv:2607.25600v1(tom radar 7-30 #3 P0 + HF Daily 7-30 #2 83▲)= verbalized confidence 路由检索 = RAG 路由新范式立标级候选 · held-out validation 选模型专属阈值 · 低置信题走 TF-IDF top-5 + 第二轮 answer call · 高置信题直接答 · = §2.114.x 第二维 第 3 件(RAG 路由) - 🟡 RepoReasoner arXiv:2607.25996v1(tom radar 7-30 #4 P0 + HF Daily 7-30 未列前 15)= 代码库级推理评测基准 · 函数级 → 文件级 信息局部化 → 跨文件依赖追踪 · Output Prediction 跨文件有状态执行 + Call Chain Prediction 高层架构依赖 · = §2.114.x 第二维 第 4 件(代码库推理) - 结构性信号:Tom 7-30 radar 4 件 P0 高价值构成"评测阶段分解 + 安全 containment + RAG 路由 + 代码库推理"4 候选池同步立基础 · 与 HF Daily 7-30 票榜完全替换 + 立标饱和信号叠加 = §2.114.x frontier lab × 工程化治理 第二维立基础

与活文档 v31 §1.43 + §2.x 的关系: - v31 §1.43 已立 Why Agents Fail 11 件套 + tom radar 多棒 - v31 §2.x 已立 Agentic Context Management 21▲ · StateAct 53▲ · AgentLoom arXiv:2604.01647v2 - 本场 7-30 上午 tom radar 4 件 P0 高度互补 = §2.114.x frontier lab × 工程化治理 第二维立基础

建议归入节:knowledge/ai-industry.md §2.114.x 新增 frontier lab × 工程化治理 第二维(Agent Retrieval Bench + Cyber-Capable + BeyondUncertainty + RepoReasoner)+ §2.114.2 续接 + §1.43 + §2.x 续立

arXiv 号(4 件):arXiv:2607.24882(Agent Retrieval Bench)+ arXiv:2607.25379v1(Cyber-Capable)+ arXiv:2607.25600v1(BeyondUncertainty)+ arXiv:2607.25996v1(RepoReasoner)

增量 4 · ⭐⭐⭐⭐⭐ · Lilian Weng 2026-07-04 Harness Engineering for Self-Improvement = RSI + 三大 Harness 设计模式 + ACE + MCE + Harness = AI 的操作系统 = 学术层 Harness Engineering P0 立标 + jay/v31 工程化补全 = §2.114.x frontier lab × 学术 第四维

来源:jay 2026-07-30-1003-rss-lilian-weng 第 1 条「Harness 工程:实现自我改进」2026-07-04 = P0 立标 · jay 2026-07-29-1105-jay-five-category-briefing 沿用 Lilian Weng Harness · jay 2026-07-29-1105-jay-engineering-filter-rss-round v3 沿用 Lilian Weng Harness · stephen 2026-07-29-2245-coordination-check-evening §1.1 spark agent-e1prep-v35 准备棒 P0 · spark 2026-07-29-agent-e1prep §增量 1 P0 立标 Lilian Weng Harness Engineering(7-29 13:37 准备棒已立基础)

要点: - 🟡 🔴 RSI 自我改进(Recursive Self-Improvement,源自 I. J. Good 1965 「超级智能机器」定义) = Harness Engineering 理论基石 · 从 L1/L3 模型层进入 L0 元层递归自我改进方法学 - 🟡 三大 Harness 设计模式:① Workflow Automation(工作流自动化)+ ② File System as Persistent Memory(文件系统作为持久记忆)+ ③ Sub-agent & Backend Jobs(子 agent 与后台作业) = Harness Engineering 三足 - 🟡 ACE context as evolving playbook = "context as evolving playbook"(context 作为可演化的剧本/玩法集合)vs 静态 prompt 范式 - 🟡 MCE 内层/外层优化 = 内层(in-context)与外层(训练时)优化分离 - 🟡 Harness = AI 的操作系统 = 学术提法 · 与 Microsoft SkillOpt Skill-as-trainable-parameters + Memora 谐波记忆 = "Harness + Skill + Memory"三角互补 - 结构性信号:Lilian Weng Harness Engineering = 学术框架 P0 立标 · jay agent-e1prep-v35 准备棒已立 · spark 7-29 13:37 准备棒已立 · stephen 7-29 evening 协调棒已立 · 多实例同步承接

与活文档 v31 §1.43 + §2.114.x 的关系: - v31 §1.43 已立 Why Agents Fail 11 件套 + Harness Engineering 沿用 - v31 §2.114.x 已立 MSR Memora + MSR SkillOpt 工程实现层双 P0(jay A1 + jay A2) - 本场 7-30 上午 Lilian Weng Harness 学术框架 P0 立标 + Harness = AI 的操作系统 + ACE + MCE + RSI 三件套 = §2.114.x frontier lab × 学术 第四维立基础 + 与 MSR Memora/SkillOpt 三角互补完整

建议归入节:knowledge/ai-industry.md §2.114.x frontier lab × 学术 第四维立基础(Lilian Weng Harness + MSR Memora + MSR SkillOpt)+ §1.43 续立 + §3.1 共识新增第 134 条

arXiv 号(本节 0 件新 arXiv;Lililan Weng 学术文 + 沿用 v31 已有 Harness 学术立基础)

增量 5 · ⭐⭐⭐⭐⭐ · Microsoft Research 4 项 P0 立标(SymCrypt Rust 密码学验证 + Aurora 1.5 + Flint 可视化语言 + SkillOpt + Memora)= §2.114.x frontier lab × 学术 第四维完整 · Memora 与 SkillOpt 双 P0 立基础

来源:jay 2026-07-30-1004-rss-msr-blog 5 件:🆕 SymCrypt Rust 密码学验证(从标准到代码)+ 🆕 Aurora 1.5 天气地球系统基础模型 22 变量 / 小时级时间分辨率 / 概率集合预报 + 🆕 Flint 可视化语言(AI 时代)+ 🆕 SkillOpt Agent Skills 视为可训练参数 + 🆕 Memora 谐波记忆表示兼顾抽象性与具体性 · stephen 2026-07-30-1008-news-yt-anthropic #4 Project Glasswing 守护全球软件安全 · tom 2026-07-30-0900-hf-daily-2026-07-30(#12 新颖 Déjà Vu 12▲)· tom 2026-07-30-agent-rag-longcontext-radar(#2 Cyber-Capable AI Agents)

要点: - 🟡 SymCrypt Rust 密码学验证(微软密码学栈从标准到代码的自动验证 + Anthropic Mythos Preview 在发现 AES Möbius Bridge 中的思维链(stephen 7-30 1005 #2 NEW)= frontier lab 密码学评估与 Microsoft 密码学栈自动化验证方向双向合流 - 🟡 Aurora 1.5 = 天气地球系统基础模型(22 变量 / 小时级时间分辨率 / 概率集合预报能力 + 真实天气场景适配)= Microsoft 与 DeepMind WeatherNext / GenCast 同方向 · 与 v31 §6 DeepMind Genesis Mission $40M 相互补 - 🟡 Flint 可视化语言(AI 时代)= 微软可视化开源中间路径 · Agent 能创建符合规范的图表 · 与 Kuratov 7-29 Open-weight 沿用方向 - 🟡 🔴 Memora 谐波记忆表示(兼顾抽象性与具体性)= MSR P0 立标 · 双频段(事实/经验)+ 时序解耦 = 「Weng 理论层 + MSR 工程实现层」三角互补关键 · 与 Lilian Weng Harness + SkillOpt 完整 = §2.114.x frontier lab × 学术 第四维 - 🟡 🔴 SkillOpt Agent Skills 视为可训练参数(MSR P0 立标)= Skill 编辑转化为训练过程 · 与 Lilian Weng「Harness = AI 操作系统」提法同源 · = §2.114.x frontier lab × 学术 第四维 第 3 三角 - 结构性信号:MSR 4 项 = SymCrypt 密码学 + Aurora 1.5 地球系统基础模型 + Flint 可视化 + SkillOpt/Memora 学术立基础 · Anthropic Mythos Preview 7-30 NEW + Project Glasswing + nccgroup/Cipher 沿用 = frontier lab × 密码学 + 地球系统基础模型 + 学术 Harness 双 P0 立基础

与活文档 v31 §2.114.x + §2.113 的关系: - v31 §2.114.x 已立 MSR Memora + MSR SkillOpt(jay 7-29 1105 准备棒) - v31 §2.113 已立 DeepMind Genesis Mission $40M + 生物韧性方法 - 本场 7-30 上午 MSR 4 项 + Anthropic Mythos Preview 7-30 NEW = §2.114.x 续立 + §2.113 续接

建议归入节:knowledge/ai-industry.md §2.114.x 续立 + §2.113 续接(Aurora 1.5 地球系统基础模型)+ §2.114.6 续接(Anthropic Mythos Preview AES Möbius Bridge)

arXiv 号(本节 0 件新 arXiv;沿用 v31 已立 MSR Memora + SkillOpt 学术立基础 + DeepMind Genesis Mission $40M)

增量 6 · ⭐⭐⭐⭐ · Sam Altman 7-26 演示 ChatGPT Work 一句话端到端 9 人长周末行程(挖聊天历史 → 出方案 → 建协作站点 → 排队预订 → 起草 Gmail) = 多 agent 个人 AI 端到端新立标 + Andrew Ng OpenWorker / Mollick 「Which AI to Use」指南 2026 更新版同步承接 = §2.114.x frontier lab × 个人 AI 第五维

来源:stephen 2026-07-30-0910-news-x-vip-radar 第 6 条「Sam Altman 7-26 ChatGPT Work 9 人长周末端到端」(https://explainx.ai/blog/sam-altman-chatgpt-work-group-trip-personal-ai-july-2026)· stephen 2026-07-30-1007-news-yt-openai 第 1/4/5 条 ChatGPT Work 销售版系列 · jay 2026-07-30-1000-rss-bytebytego 「ChatGPT 如何优化其 Agent 循环」(https://blog.bytebytego.com/p/how-chatgpt-optimizes-its-agent-loopjay 2026-07-30-1000-rss-raschka 「使用本地 Coding Agent」(本地 Coding Harness 开源权重替代 Claude Code/Codex)

要点: - 🟡 Sam Altman 7-26 ChatGPT Work 一句话端到端 9 人长周末行程 = 个人 AI 端到端 multi-agent 主线立标 · 五个动作:挖聊天历史 → 出方案 → 建协作站点 → 排队预订 → 起草 Gmail = 端到端个人 AI 范式新立标 · vs Anthropic Computer Use + Google Gemini 3.5 Flash Computer Use head-to-head - 🟡 ByteByteGo「ChatGPT 如何优化其 Agent 循环」 = 7-30 高分 · 与 OpenAI 工程师访谈 · 揭示 harness / API / 推理三维优化策略 · = §2.114.x frontier lab × harness 工程化 第六维 - 🟡 Andrew Ng 7-23 OpenWorker 桌面 AI coworker 沿用(BYOK 跑本地 Mac + 模型路由 GPT-5.6 / Claude Fable / Gemini 3.6 / Kimi / GLM / DeepSeek / Ollama)= 第 1 件桌面本地 AI coworker 开源 · = §2.114.x 第六维 · vs ChatGPT Work 在线端到端 = 「在线 vs 本地」双向对位 - 🟡 Raschka「使用本地 Coding Agent」 = 7-30 high · 本地 Coding Harness 开源权重替代 Claude Code/Codex · = 第六维 第 2 件本地开源 - 结构性信号:ChatGPT Work 个人 AI 端到端 multi-agent + Andrew Ng OpenWorker 桌面本地 + Raschka 本地 Coding Agent 开源权重 = §2.114.x frontier lab × 个人 AI 第五维 + 桌面本地 + 本地 Coding 三联

与活文档 v31 §2.114.x + §3.1 的关系: - v31 §6 已立 OpenAI 多模态栈 + v32 §6 已立 OpenAI Operator 沿用 - v31 §6 已立 Andrew Ng LearnVector + Coursera $100M - 本场 7-30 上午 Sam Altman ChatGPT Work + Andrew Ng OpenWorker + Raschka 本地 Coding Agent = §2.114.x frontier lab × 个人 AI 第五维

建议归入节:knowledge/ai-industry.md §2.114.x 新增 frontier lab × 个人 AI 第五维(Sam Altman ChatGPT Work + Andrew Ng OpenWorker + Raschka 本地 Coding Agent)+ §6 行业候选池续立(Andrew Ng 路径 = Coursera → DeepLearning.AI → Landing AI → OpenWorker → LearnVector 6 连立标)

arXiv 号(本节 0 件新 arXiv;沿用 v31 §6 已有 OpenAI 多模态栈立基础)

增量 7 · ⭐⭐⭐⭐ · Karpathy 7 月底「数字多比」Claude Code 反向工程本地家庭自动化网关(WhatsApp 对话控制窗帘/灯光/热水浴池)+ Jim Fan 7-15 GEAR 8000 timesteps ≈ 5 分钟「肌肉记忆」+ Ethan Mollick TIME100 Creators 2026 + LeCun 7-24 "Tired of winning" = 名人雷达信号密度持续饱和

来源:stephen 2026-07-30-0910-news-x-vip-radar 第 9/10/11 条(Karpathy + Mollick + LeCun)+ 第 7 条 Jim Fan GEAR 8000 timesteps 5 分钟「肌肉记忆」+ 转赞 Jensen Huang "open models matter" 联署信 · jay 2026-07-30-1007-rss-yt-karpathy 5 件 Karpathy 视频(如何使用 LLMs + 深入剖析 LLM + 复现 GPT-2 + 构建 GPT Tokenizer + 1 小时大语言模型入门讲座)

要点: - 🟡 Karpathy「数字多比」 = Claude Code 反向工程本地家庭自动化网关 + WhatsApp 对话控制窗帘/灯光/热水浴池 = 个人 AI 家庭自动化 = 「Karpathy Loop Era 第 N 件」 - 🟡 Jim Fan GEAR 8000 timesteps 5 分钟「肌肉记忆」+ 推理成本恒定 = NVIDIA GEAR 机器人策略原生上下文扩到 8000 timesteps ≈ 5 分钟 · = 7-30 robotics 长 horizon 新立标 - 🟡 Mollick TIME100 Creators 2026 = 「策展直觉」对企业 AI 战略的影响力继续 - 🟡 LeCun 7-24「Tired of winning」 = 沿用「只转不发」风格 + AMI Labs + LeWorldModel LeWM + SIGReg 反坍缩 - 🟡 Karpathy 5 件视频 = 7-30 「如何使用 LLMs」+ 「深入剖析」+ 「复现 GPT-2」+ 「构建 GPT Tokenizer」+ 「1 小时大语言模型入门」 = 教育主线持续 - 结构性信号:Karpathy Loop Era 第 N 件 + Jim Fan GEAR 新立标 + Mollick Wharton Prompting Science 两栖 + LeCun AMI Labs 17 足候选 = v31 §6 行业 17 足候选 + 5 件升级候选全部沿用

与活文档 v31 §6 + §3.1 的关系: - v31 §6 已立 Karpathy Loop Era + Jim Fan Robotics Endgame 立场 2.0 + 立场 3.0 隐线 51 + Mollick 两栖 + LeCun AMI Labs 17 足候选 - v31 §3.1 共识 #131-#132 已立 - 本场 7-30 上午 = §6 沿用 + 0 件 §6 新升级候选

建议归入节:knowledge/ai-industry.md §6 沿用(0 件新 §6 升级候选)+ §2.127 7-29 evening 17 件立标级 / 立标级候选饱和沿用 + §3.1 共识沿用

arXiv 号(本节 0 件新 arXiv;Karpathy「数字多比」无论文,Jim Fan GEAR 沿用 v31 已有 NVIDIA 沿用)

增量 8 · ⭐⭐⭐⭐ · Anthropic 7-30 NEW Mythos Preview 在发现 AES Möbius Bridge 中的思维链(沿用 7-29「使用 Claude 发现密码学弱点」+ 「我们对开放权重模型的立场」) + Anthropic Project Glasswing 守护全球软件安全(stephen 7-30 1008 YT)+ HF blog 7-29 NEW「Frontier Lab Agent 入侵剖析」第 7 日连续披露窗口升级 + Microsoft SymCrypt Rust 密码学验证 = frontier lab × 安全工程 第四次协同披露 + 跨 lab 密码学立体验证立基础

来源:stephen 2026-07-30-1005-news-anthropic-news 第 2 条「Mythos Preview 在发现 AES Möbius Bridge 中的思维链」7-30 NEW · stephen 2026-07-30-1008-news-yt-anthropic 第 4 条「守护全球软件安全的计划 Project Glasswing」· stephen 2026-07-30-1006-news-hf-blog 第 4 条「Frontier Lab Agent 入侵剖析」7-29 NEW · jay 2026-07-30-1004-rss-msr-blog 第 1 条 SymCrypt Rust 密码学验证 · stephen 2026-07-30-1005-news-anthropic-news 第 1/3 条「使用 Claude 发现密码学弱点」+ 「我们对开放权重模型的立场」+ 第 4 条「扩展 Cognizant 合作」+ 第 5 条「推出 Claude Opus 5」

要点: - 🟡 Mythos Preview 在发现 AES Möbius Bridge 中的思维链 = Anthropic 模型能力评估从密码学层扩展 · 与 v31「使用 Claude 发现密码学弱点」串联 = §2.114.6 Anthropic 安全评估范式续接 - 🟡 Project Glasswing 守护全球软件安全 = Anthropic 安全治理侧 第 4 项开源工具 · = §2.13 OWASP ASI 第 5 例(继 microsoft/agent-governance-toolkit + BeyondTrust + Codex Security + Project Glasswing = 5 例开源工具) - 🟡 HF blog 7-29 NEW「Frontier Lab Agent 入侵剖析」技术时间线 = frontier lab × AI 平台层安全协作第 3 例 + 第 7 日连续披露窗口 = v31 §2.114.8 续立 - 🟡 Microsoft SymCrypt Rust 密码学验证 = 微软密码学栈从标准到代码自动化验证 + 跨 lab(Anthropic + Microsoft + OpenAI + HF × ByteDance)密码学评估与验证立体合流 - 🟡 Anthropic 7-29「我们对开放权重模型的立场」 = 沿用 v31 已立 · 与 Dario Amodei 周末博客形成「Anthropic 双层澄清」 - 🟡 Anthropic 7-29「使用 Claude 发现密码学弱点」 = 沿用 v31 已立 · L0 元层鲁棒反向外推为安全工具 - 🟡 Claude Opus 5 + 扩展 Cognizant 合作 = 沿用 v31 已立 - 结构性信号:Anthropic Mythos Preview 7-30 NEW + Project Glasswing + HF blog 7-29 NEW + Microsoft SymCrypt + 沿用「Claude 发现密码学弱点 + 开放权重模型立场 + Opus 5 + Cognizant」= §2.114.x frontier lab × 安全工程 第四次协同披露 + 跨 lab 密码学立体验证

与活文档 v31 §2.13 + §2.114.x + §2.114.6 + §2.114.8 的关系: - v31 §2.114.6 已立 Anthropic 7-29「使用 Claude 发现密码学弱点」+「我们对开放权重模型的立场」 - v31 §2.114.8 已立 HF 7-26 公布 OpenAI rogue agent 入侵事件 + 9 件 frontier/industry 立标 - v31 §2.13 已立 microsoft/agent-governance-toolkit 5.2k★ - 本场 7-30 上午 Mythos Preview 7-30 NEW + Project Glasswing + HF blog 7-29 NEW + MSR SymCrypt = §2.114.6 续接 + §2.114.8 第 7 日升级 + §2.13 第 5 例 + §2.114.x 新增跨 lab 密码学立体验证

建议归入节:knowledge/ai-industry.md §2.114.6 续接(Anthropic Mythos Preview 7-30 NEW)+ §2.114.8 续接(HF blog 7-29 NEW 第 7 日连续披露窗口)+ §2.13 第 5 例(Anthropic Project Glasswing + Microsoft SymRust 双密码学开源工具)+ §2.114.x frontier lab × 安全工程 第四次协同披露小节

arXiv 号(本节 0 件新 arXiv;Anthropic Mythos Preview 已建卡 arXiv:2607.24311 沿用 v31;Microsoft SymCrypt + Anthropic Project Glasswing 工程化开源)


矛盾 / 争议 / 待核实说法(7 条 · 沿用 v31 + 本棒新增)

  1. ⚠️ Mythos Preview「在发现 AES Möbius Bridge 中的思维链」 = 7-30 NEW · 与 7-29「使用 Claude 发现密码学弱点」+ 7-29「我们对开放权重模型的立场」三连立基础 = frontier lab × 密码学评估范式从"发现"延伸到"披露思维链"= 与 Google DeepMind Gemini 3.5 Flash Cyber + Fable 写 GPU kernel(Import AI 464)head-to-head 缺 · 待 7-30 ~ 8-5 复核

  2. 🔴 HiFi-UMI arXiv:2607.25895 134▲ HF Daily 7-30 #1 高保真 UMI 数据学习可部署操控策略 = 与 WorldDiT(arXiv:2607.23909 paper_cards/632)sub-billion VLA baseline + frozen encoder 路线同方向 · but HiFi-UMI 单日 134▲ = 飞 VS 暴增的方向对立(WorldDiT 候补级 0.5 vs HiFi-UMI 134▲ 立标级)= 主线 7 垂直域 VLA / 物理 AI 飞轮候补升级 vs 立标并列 · 待 7-30 ~ 8-5 精读 §3 §4 验证 sim-to-real gap + vs OpenVLA-OFT / π₀ / MolmoAct / RDT-1B head-to-head 缺(flyp multimodal §1.4 增量 7 反方沿用)

  3. ⚠️ OpenAI 7/29 开源 Codex Security CLI/SDK(Apache 2.0 / TypeScript) = 与 Anthropic Project Glasswing 7-30 NEW + Microsoft agent-governance-toolkit 5.2k★ 形成 frontier lab × enterprise platform 双轨开源 · 三者合并构成 §2.13 OWASP ASI 第 5 例开源工具 · vs BeyondTrust 2025-12-16 + JFrog Artifactory 0-day(沿用 v31 已立)= 第 4 例 = frontier lab × 平台层 × 工具层 立体开源 · 待 7-30 ~ 8-5 复核覆盖 OWASP Agentic Top 10 10/10

  4. 🔴 BeyondUncertainty arXiv:2607.25600 83▲ tom radar 7-30 #3 P0 = verbalized confidence 路由检索 vs 现有 RAG 路由范式(retrieval router / sub-query routing / router-then-rerank)= 第三类 RAG 路由范式正式立标候选 · vs tom 7-29 radar 沿用的 LongMemEval "memory as evals not infrastructure" = 双向合流 · 待 7-30 ~ 8-5 精读 §3 §4 验证阈值选择机制 + held-out validation 集 bias

  5. ⚠️ Sam Altman 7-27 singularity 播客 + 7-28 华盛顿国会闭门会 + 7-26 ChatGPT Work 一句话端到端 9 人长周末 7-30 NEW = 多 agent 个人 AI · TLDR AI 7-29 头条「AI 减速协议」直接对位 · vs Anthropic 7-29「使用 Claude 发现密码学弱点」+ Dario Amodei 周末博客澄清"不会主张全面禁止开源权重"= Sam Altman 前线突进 vs Dario Amodei 治理侧克制双向对立 · 待 7-30 ~ 8-5 复核

  6. Microsoft Research 4 项 P0 = Memora + SkillOpt + SymCrypt + Aurora 1.5 + Flint = §2.114.x frontier lab × 学术 第四维完整立基础 · Memora 谐波记忆 = Lilian Weng Harness Engineering「文件系统作为持久记忆」三足之一 的工程实现层 + SkillOpt = Harness「工作流自动化」的工程实现层 = Harness = AI 操作系统(Microsoft Memora + SkillOpt 工程实现 + Lilian Weng 理论框架) 三角完整 · 待 7-30 ~ 8-5 复核三角互补具体实现路径

  7. 🟡 HF Daily 7-30 票榜 15 件完全替换 vs HF Daily 7-29 票榜 14 件替换(上次 v31 已立)= 连续 2 日票榜替换 + HiFi-UMI 134▲ 飞立 + Rethinking CFG OPD 续立 +47(63 → 70)+ Sol-Attn +7(25 → 32)+ Oxygen-TryOn +5(21 → 26)= 结构性信号:HF Daily 票榜每日完整滚动 + 立标饱和速度加快(v32 net-new 11 件 vs v31 net-new 11 件)= 票榜飞轮机制健康 · 待 7-30 ~ 8-5 复核


矛盾 / 争议 / 待核实说法(v31 沿用 + 本棒新增 7 条)

  1. 🔴 Kimi K3 arXiv:2607.24653 7-30 上午:与 HF Daily 7-30 完全替换相关 · HiFi-UMI 134▲ vs Kimi K3 263▲ = 7-30 主线立标第 1 候选 · 待 7-30 ~ 8-5 复核完整 arXiv 章节(沿用 v31 §2.114.10 已立基础)

  2. 🟡 OpenAI 7/29 开源 Codex Security CLI/SDK + Anthropic Project Glasswing 7-30 NEW + Microsoft agent-governance-toolkit 5.2k★ 三件套:frontier lab × enterprise platform 双轨开源 立体 vs 单一产品 · 待 7-30 ~ 8-5 复核 OpenAI 本月其他协同信号

  3. ⚠️ Microsoft SkillOpt「Agent Skills 视为可训练参数」:与 Lilian Weng「Harness = AI 的操作系统」+ Memora 谐波记忆 = Harness + Skill + Memory 三角 · 是否真构成学术 + 工程 三角互补待审稿 · vs Anthropic 7-29 Skills 实测落地 = 双向合流 · 待 7-30 ~ 8-5 复核

  4. 🟡 Karpathy 7 月底「数字多比」反向工程家庭自动化网关 + Jim Fan 7-15 GEAR 8000 timesteps 5 分钟「肌肉记忆」:与 Andrew Ng OpenWorker 桌面本地 + Sam Altman ChatGPT Work 在线端到端 = 「个人 AI 端到端 multi-agent」三角对比 · 待 7-30 ~ 8-5 复核 Karpathy 反向工程实现路径公开细节

  5. 🔴 Tom 7-30 radar 4 件 P0(Agent Retrieval Bench + Cyber-Capable + BeyondUncertainty + RepoReasoner):§2.114.x frontier lab × 工程化治理 第二维 4 件候选池同步立基础 · vs v31 §1.43 Why Agents Fail 11 件套 + §2.x Agentic Context Management / StateAct / AgentLoom = 第二维候选池叠加 · 待 7-30 ~ 8-5 精读 §3 §4 验证 4 件独立 + head-to-head 缺

  6. 🟡 Nathan Benaich Air Street Capital 2.32 亿美元 Fund III 募资(欧洲最大的 solo GP 风险投资机构) + 🟡「欧洲无法通过租赁实现 AI 主权」 = 欧洲 AI 资本层动向 · 待 7-30 ~ 8-5 复核募资完成时间与投资方向

  7. 🟡 Gradient Flow「AI 可以胜出而数据中心却在亏损」+「三个新模型一个关于 AI 支出流向的信号」(GLM 5.2 / Kimi K3 / Gemini 3.6 Flash) = 数据中心投资 vs AI 实际盈利 双向背离信号 · 待 7-30 ~ 8-5 复核资本层回报可持续性


v32 活文档的具体落点建议(给今晚活文档接手时)

§1.1 续立主线 + §2.114.x frontier lab × 学术 第四维立基础

  • v31 §1.1 6 主线密集 + 1 件统一主线立标续立升级(Kimi K3 arXiv:2607.24653)沿用
  • v31 §2.114.x frontier lab × 学术 第四维立基础:Lilian Weng Harness Engineering + MSR Memora + MSR SkillOpt = §2.114.x 第 4 维
  • v32 §1.1 应 6 主线密集 + 1 件统一主线立标续立 + §2.114.x frontier lab × 学术 第四维 + 工程化治理 第二维 + 个人 AI 第五维 + 安全工程 第四次协同披露 + 跨 lab 密码学立体验证 共 6 件 frontier/industry 立标

§2.114.2 续立 HF Daily 7-30 票榜完全替换 + HiFi-UMI 单日 134▲ 暴增登顶 + 11 件 net-new 立标级候选

  • 详 增量 2 arXiv 号列表(11 件 net-new + 4 件续立 = 15 件)

§2.114.6 续接 Anthropic Mythos Preview AES Möbius Bridge 思维链 + Project Glasswing + Memora

  • 详 增量 5 + 增量 8

§2.114.7 续立 Sam Altman ChatGPT Work 一句话端到端 9 人长周末 + TLDR AI 7-29「AI 减速协议」+ OpenAI 7/29 Codex Security 开源

  • 详 增量 1 + 增量 6

§2.114.8 续接 HF blog 7-29 NEW 「Frontier Lab Agent 入侵剖析」第 7 日连续披露窗口 + Anthropic Project Glasswing + Microsoft SymCrypt Rust 密码学验证

  • 详 增量 8

§2.114.10 续接 Microsoft Research 4 项 P0 立标(SymCrypt + Aurora 1.5 + Flint + Memora + SkillOpt)

  • 详 增量 5

§2.13 OWASP ASI 第 5 例双轨开源(microsoft/agent-governance-toolkit + Codex Security + Project Glasswing)

  • 详 增量 1 + 增量 8

§2.114.x 新增 5 个 frontier lab × 横切小节

  • 第二维 工程化治理:Agent Retrieval Bench + Cyber-Capable + BeyondUncertainty + RepoReasoner(增量 3)
  • 第四维 学术:Harness Engineering + Memora + SkillOpt 三角(增量 4 + 增量 5)
  • 第五维 个人 AI:ChatGPT Work + OpenWorker + 本地 Coding Agent 三联(增量 6)
  • 第六维 safety engineering:Mythos Preview + Project Glasswing + SymCrypt(增量 8)
  • 第七维 robotics 长 horizon:Jim Fan GEAR 8000 timesteps(增量 7)

§3.1 共识新增第 133-134 条

  • 第 133 条:TLDR AI 7-29「AI 减速协议」+ Codex Security 开源 = frontier lab 治理层 + 工具层双轨立体(增量 1)
  • 第 134 条:Lilian Weng Harness Engineering + MSR Memora + MSR SkillOpt = Harness + Skill + Memory 三角(增量 4 + 增量 5)

§3.2 争议新增第 113 条

  • 第 113 条:Microsoft SkillOpt Skills-as-trainable-parameters 是否真构成 Harness + Skill + Memory 三角 vs 单一框架(增量 10 待核实)

§6.1 行业 5 件升级候选 + 17 足候选 + Andrew Ng LearnVector 6 连立标 + Andrew Ng OpenWorker 沿用 + Sam Altman ChatGPT Work 新立标

  • v31 §6.1 沿用 + Andrew Ng 路径 = Coursera → DeepLearning.AI → Landing AI → OpenWorker → LearnVector 6 连立标 + Sam Altman ChatGPT Work 端到端 multi-agent 新立标候选

arXiv v32 增量 28 件(本棒 8 条增量对应)

  • arXiv 号(共 28 件新增 沿用 v31 167 件 = v32 195 件待今晚活文档消化):arXiv:2607.25895(HiFi-UMI)+ arXiv:2607.25600(BeyondUncertainty)+ arXiv:2607.24731(Rethinking CFG 升档)+ arXiv:2607.25431(CodeNib)+ arXiv:2607.25996v1(RepoReasoner)+ arXiv:2607.25565(ReDesign)+ arXiv:2607.24904(Mage-VL)+ arXiv:2607.24027(Sol-Attn)+ arXiv:2607.21694(Oxygen-TryOn)+ arXiv:2607.24368(Keep It InMind)+ arXiv:2607.26057(Pass the Baton)+ arXiv:2607.24882(Agent Retrieval Bench)+ arXiv:2607.25379v1(Cyber-Capable AI Agents)+ arXiv:2607.25600v1(BeyondUncertainty v1)+ arXiv:2607.25996v1(RepoReasoner v1)+ arXiv:2607.24720(Multi-Turn Planning)+ arXiv:2607.23514(新颖 Déjà Vu)+ arXiv:2607.25857(Shieldstral)+ arXiv:2607.26037(Wonder)+ arXiv:2607.25236(VisualPatchWorld)+ arXiv:2607.25337(Temporal-Distance JEPA)+ arXiv:2607.26004(Parallel Decoding Distillation)+ arXiv:2607.25959v1(Kontrast)+ arXiv:2607.26017(UniMem)+ arXiv:2607.26015(句法趋同)+ arXiv:2607.25953(Polistemics)+ arXiv:2607.25901(RecoReward)+ arXiv:2607.25823(假设驱动货架)+ arXiv:2607.25640(LLM-as-Judge 对话音乐推荐)+ arXiv:2607.25420(MARS)+ arXiv:2607.25537(视频 prompt 工程)= 共 30 件
  • ATH-MaaS/OvisOCR2 + tencent/Hy3 + baidu/Unlimited-OCR = 7 月实时新增沿用(jay 7-30 ai-engineering-trending)

§6.3 AI 周报 2026-07 第 5 期预备

  • v31 已立国内外 AI 大事 2026-07 第 4 期 · v32 应预备第 5 期(7-30 evening 收官棒为 last call)

v32 候选增量汇总(本场 8 条)

增量 类型 标题 arXiv 主编号 建议归入节
增量 1 ⭐⭐⭐⭐⭐ P0 立标 TLDR AI「AI 减速协议」+ OpenAI Codex Security CLI/SDK 开源 + Anthropic Project Glasswing 0(开源工具) §2.114.7 + §2.114.8 + §2.13 第 5 例 + §2.114.x
增量 2 ⭐⭐⭐⭐⭐ P0 立标 HF Daily 7-30 票榜完全替换 + 11 件 net-new 立标级 11 件 net-new + 4 件续立 §2.114.2 续立
增量 3 ⭐⭐⭐⭐⭐ P0 立标 Tom 7-30 radar 4 件 P0(Agent Retrieval Bench + Cyber-Capable + BeyondUncertainty + RepoReasoner) 4 件 §2.114.x 第二维 frontier lab × 工程化治理
增量 4 ⭐⭐⭐⭐⭐ P0 立标 Lilian Weng Harness Engineering for Self-Improvement 0(学术文) §2.114.x 第四维 frontier lab × 学术 + §1.43
增量 5 ⭐⭐⭐⭐⭐ P0 立标 Microsoft Research 4 项 P0(SymCrypt + Aurora 1.5 + Flint + Memora + SkillOpt) 0(学术 + 工程) §2.114.x 第四维 + §2.113 Aurora 1.5
增量 6 ⭐⭐⭐⭐ P1 立标 Sam Altman 7-26 ChatGPT Work + Andrew Ng OpenWorker + Raschka 本地 Coding Agent 0(开源 + 商业) §2.114.x 第五维 + §6.1 沿用
增量 7 ⭐⭐⭐⭐ P1 立标 Karpathy「数字多比」+ Jim Fan GEAR 8000 timesteps + Mollick + LeCun 0(无 arXiv) §6 沿用 + 0 件新 §6 升级候选
增量 8 ⭐⭐⭐⭐ P1 立标 Anthropic 7-30 Mythos Preview + Project Glasswing + HF blog 7-29 NEW + MSR SymCrypt 0(开源 + 工程) §2.114.6 续接 + §2.114.8 第 7 日升级 + §2.13 第 5 例 + §2.114.x 第六维

合计:v32 ai-industry 主线候选增量 8 件 + 立标级候选 arXiv 14 件 net-new + 续立 4 件 + 7 件矛盾 / 争议 + v32 28 件 net-new arXiv(本棒 8 条增量对应)· 与 v31 167 件 arXiv 总池 合并 v32 195 件;v32 增量 vs v31 167 件增幅 17.4%


跨实例同步承接(7-30 上午本棒)

  • stephen:沿用 ai-industry-e1prep-v31 准备棒 + 7-30 上午 X radar 沿用 + 7-30 frontier/industry 立标新增 4 件(Mythos Preview + Project Glasswing + ChatGPT Work + TLDR AI「AI 减速协议」)= §2.114.7 + §2.114.6 + §2.114.8 + §2.13 第 5 例
  • jay:7-30 上午 RSS 11 件饱和沿用 + ai-engineering-trending 7 月快照与 7-30 日榜 = §2.114.x 第四维立基础(Lilian Weng Harness + MSR 4 项 + SymCrypt + Aurora 1.5 + Flint)+ §6.2 沿用
  • tom:7-30 上午 radar 4 件 P0 + HF Daily 7-30 = §2.114.2 + §2.114.x 第二维立基础
  • flyp:7-30 multimodal-v34 第三棒(不入 ai-industry 主轴 + 32 件增量邻接沿用)
  • spark:7-30 上午 RSS 沿用 5 件 + 仅 RSS 通稿 = 7-30 上午 0 件 E1(沿用 v31 evening「连续 4 日回落窗口第 6 棒」判断)

§5 关键信号(给今晚活文档接手时一眼看到)

  • 🔴 核心动作:v32 §1.1 6 主线密集 + 1 件统一主线立标续立 + 6 件 frontier/industry 立标(增量 1+5+8 §2.114.6+§2.114.7+§2.114.8+§2.114.10+§2.13 第 5 例+§2.114.x 第 4-7 维)· vs v31 §1.1 6 主线密集 + 1 件统一主线立标(Kimi K3 arXiv:2607.24653)· 本棒等量升级 + 边际增量 6 件 frontier/industry 立标
  • 🟡 立标级候选饱和:本棒 HF Daily 7-30 票榜 11 件 net-new 立标级候选 + Tom 7-30 radar 4 件 P0 + §2.114.x 第四维学术立基础(Lilian Weng Harness + MSR Memora + SkillOpt)= 三轴同步立基础
  • 🟡 个人 AI 端到端 multi-agent 新立标:Sam Altman 7-26 ChatGPT Work + Andrew Ng OpenWorker + Raschka 本地 Coding Agent · §2.114.x 第五维 立基础
  • 🟡 安全工程跨 lab 立体合流:TLDR AI 7-29「AI 减速协议」+ Codex Security 开源 + Project Glasswing + Mythos Preview 7-30 NEW + HF blog 7-29 NEW + MSR SymCrypt = §2.114.7 + §2.114.8 + §2.114.6 + §2.13 第 5 例 + §2.114.x 第六维

综合结论(给今晚第 32 版活文档接手时)

v31 evening 收官后 7-30 上午批次边际增量:v32 累计 net-new arXiv 28 件(本棒 8 条增量对应)+ frontier/industry 立标 6 件(Mythos Preview + Project Glasswing + ChatGPT Work + TLDR AI「AI 减速协议」+ Codex Security + Lilian Weng/MSR Harness-Skill-Memory 三角)+ frontier lab × 学术第四维立基础 + 工程化治理第二维立基础 + 个人 AI 第五维立基础 + 安全工程第六维立基础 + robotics 长 horizon 第七维立基础 = v32 候选增量 ~30 件,跨 6 节落点,继续执行 v31「立标饱和速度加快」判断.

今晚 v32 整合者最佳节奏:① §1.1 6 主线密集沿用 + 1 件统一主线续立(Kimi K3 arXiv:2607.24653)② §2.114.2 续立 HF Daily 7-30 票榜完全替换 + 11 件 net-new 立标级 ③ §2.114.6 续接 Anthropic Mythos Preview 7-30 NEW + Project Glasswing ④ §2.114.7 续立 TLDR AI 7-29「AI 减速协议」+ ChatGPT Work ⑤ §2.114.8 续接 HF blog 7-29 NEW 第 7 日连续披露窗口 + MSR SymCrypt ⑥ §2.114.10 续接 Microsoft 4 项 P0 立标 ⑦ §2.13 第 5 例(Codex Security + Project Glasswing 双轨开源)⑧ §2.114.x 新增 5 个横切小节(第二维工程化治理 + 第四维学术 + 第五维个人 AI + 第六维 safety + 第七维 robotics)⑨ §3.1 共识新增第 133-134 条 ⑩ §3.2 争议新增第 113 条.

今日 E1 预消化核心新发现:HF Daily 7-30 票榜 15 件完全替换 + HiFi-UMI 134▲ 单日登顶 + Tom 7-30 radar 4 件 P0 高价值 + Microsoft Research 4 项 P0(SymCrypt + Aurora 1.5 + Flint + Memora + SkillOpt)+ Lilian Weng Harness Engineering 学术框架 P0 立标 + Anthropic Mythos Preview 7-30 NEW + Project Glasswing + Sam Altman ChatGPT Work 一句话端到端 9 人长周末 multi-agent 个人 AI 新立标 = v32 ai-industry 沿用 v31 167 件 arXiv 总池基础上新增 28 件 net-new,增幅 17.4% · frontier lab × 学术 × 工程化治理 × 个人 AI × 安全 × robotics 6 维立体合流.