ai-industry · E1 预消化简报(2026-08-02)

执行: Stephen · 2026-08-02 10:20 CST · 主题活文档承接 v33(2026-07-31 22:00 evening 棒,176 主线 / 145 共识 / 119 争议 / 219 开放问题 / 约 220 arXiv / 12 CVE / 约 196 URL) E1 窗口: 2026-08-01 22:00 → 2026-08-02 22:00 CST 24h(为今晚 v34 接力棒备料) 本期定位: v33 evening 棒为最近一版,本期预消化主要消化 8-1 22:00 之后(~12h)落到 inbox 的新内容;多数 frontier news 仍沿用 v33,但 8-2 早上抓到若干 v33 未入档的 net-new 立标候选。


一、本期最重要的 7 条增量

增量 1 · HF Daily 8-2 票榜 8 件 net-new 候选 + Metis 单日 +113 翻倍级 = 评论层 → 票榜立标层 续立/翻倍 第 7 例

来源: - inbox/tom/2026-08-02-0900-hf-daily-2026-08-02.md(HF Daily 8-2 0900 CST · 15 篇按社区票数排序) - 间接: inbox/jay/2026-08-02-1001-rss-cool-papers.md(其中 4 件与 HF Daily 8-2 重合)

要点(票数 = 社区票 ▲): - #1 AskChem arXiv:2607.28618 — 290▲ — 化学文献合成基础设施,以声明为中心的检索合成(新进) - #2 Qwen-UI-Agent arXiv:2607.28227 — 278▲ — 阿里 Qwen 团队面向真实世界 GUI Agent 的技术报告(新进)= 中国系学术侧 GUI Agent 立标候选 - #3 Metis arXiv:2607.26760 — 254▲(v33 沿用 7-31 票榜 88▲ → 8-2 单日 +113 翻倍级)= Memory Foundation Model 概念跨日翻倍立标级候选升档(v33 §2.139 已 P0;现 254▲ 触飞轮) - #4 Frontis-MA1 arXiv:2607.28568 — 162▲ — 递归自我改进 AI4AI 模型训练(新进)= 与 §2.130 Tom radar P0 + Lilian Weng Harness P0 形成「RSI 三联立」(MSR SkillOpt 静态 vs EvoLib 持续 vs Frontis-MA1 递归) - #5 PhiZero arXiv:2607.28624 — 156▲ — 围绕物理语言构建的世界模型(新进)= 与 Gemini Robotics ER 2 推理 + HumanCLAW 飞轮形成「世界模型 8-2 三件套」 - #6 DistillAlign arXiv:2607.26811 — 88▲ — 自回归视频蒸馏中模式覆盖与模式寻求的协同(新进) - #7 VideoCoCo arXiv:2607.27380 — 64▲ — Agentic 双引擎物理一致视频生成代码即思维链(新进) - #8 Memory Decoder at Scale arXiv:2607.27919 — 48▲ — 预训练的参数化长期记忆(新进)= Metis 原生 memory + Memory Decoder 参数化 memory 双向立基础 - #9 Beacon arXiv:2607.28595 — 46▲ — 理解何时以及如何进行 Agentic 视觉推理(新进) - #10 CLBench-V arXiv:2607.25294 — 44▲(v33 §2.137 已 #9 40▲ → 8-2 单日 +4 续立) - #11 BM25 Wins at Scale arXiv:2607.26497 — 41▲ — RAG 范式可扩展性研究(新进)= BM25 在 RAG scaling 下反超 dense retrieval 立标(与 v33 §2.130 Tom radar P0 Memory 三联立形成「memory + RAG」双线翻倍) - #12 Flux-OPD arXiv:2607.28022 — 39▲ — 基于演化上下文的在策略蒸馏(新进)= v33 §2.137 DecoEvo 演化进化的姐妹篇 - #13 MPIE-Bench arXiv:2607.27616 — 37▲ — 解剖学合理的多人交互编辑基准(新进) - #14 ACE-Data-0 arXiv:2607.28625 — 34▲ — 以人为中心的环境式捕获作为具身数据引擎(新进)= 与 Gemini Robotics 2 + HiFi-UMI 7-31 续立 + Apptronik Apollo 2 同台演示形成 8-2 早上「具身数据 8-2 三件套」 - #15 Beyond Borrowed Histories arXiv:2607.27816 — 30▲(新进,paper_cards/679 已建卡 evaluation 主分类)= 交互式角色扮演评估的个性化用户模拟

与活文档现有脉络的关系: 与 v33 §2.137 HF Daily 7-31 票榜 13 件替换 + HiFi-UMI 141▲ 续立 + TurboVLA 120▲ 新进 #2 + CodeNib 翻倍立标级候选升档 = 同一机制跨日续立 + 8-2 早上 7 件 7-31 票榜残留件续立(HiFi-UMI / 相关性新角色 / CLBench-V 等)+ 9 件 net-new = 评论层 → 票榜立标层 续立/翻倍 第 7 例(承接 v33 第 6 例)。立标饱和速度 v34 = v33 持平(8-2 9 件 vs 7-31 9 件 net-new)。

建议归入: §2.137 扩展子节(新增 HF Daily 8-2 票榜 9 件新进 + 翻倍立标级候选升档);建议作为 v34 §2.137 修订候选。


增量 2 · OpenAI 8-2 早 5 件集中 = frontier lab 学术立基础 + 欧洲合规 + 零售落地 + 安全实战 4 维同时推

来源: - inbox/stephen/2026-08-02-1003-news-openai-news.md(OpenAI 官方 RSS 8-2 1003 CST 5 件) - 间接: inbox/jay/2026-08-02-1001-rss-simon-willison.mddeepseek-ai/DeepSeek-V4-Flash-0731(7-31)+ 数学与理论计算机科学的十大进展(8-1 8-1 1003)= DeepSeek V4 Flash 沿用 + 数学十项进展 v33 未入档

要点(5 件 + 1 件旁证): - 🔴 数学与理论计算机科学十项进展(OpenAI 8-2 Index 新发布 + Simon Willison 8-1 8-1 1003 同步):几何 / 密码学 / 复杂性等长期开放问题新成果。几天前 Anthropic 使用 Mythos Preview 通过 Claude 发现加密弱点(耗资 100,000 美元).= OpenAI 学术立基础 + 与 Anthropic 密码学立标 双向对位(Mythos Preview 7-29 vs OpenAI 数学十项 8-2 = Anthropic 产业侧 + OpenAI 学术侧 分庭) - 🟡 构建丰沛的智能(building abundant intelligence):全栈方法让先进 AI 更强大、更经济、更广泛可用 = OpenAI 全栈战略级表述立基础(呼应 Sam Altman 7-27 「GPT-5.6 Sol is literally all I need, OpenAI could stop shipping new models tomorrow」与 v33 §2.140 GPT-5.6 价格战 Luna 80% + Terra 20% 形成 OpenAI 价格战略 4 件套) - 🟡 推动负责任 AI 在欧洲落地:OpenAI 介绍安全、保密、透明与溯源实践如何支撑欧洲负责任 AI 治理 = OpenAI 欧洲合规立基础(与 EU AI Act 2026-08-02 倒计时 48 小时 + v33 §2.115 ~ §2.119 EU AI Act 5 项关联 + jay 7-31 evening briefing EU AI Act 透明度执法 同步 = 「OpenAI 合规介入 vs EU 监管落地」双向) - 🟡 Univé 打造 AI 时代就绪的员工队伍:ChatGPT Enterprise + 领导力 + 负责任治理 + 员工主导创新 = OpenAI 企业版又一实战立标(与 v33 §2.140 avatarin 30,000 用户零售 + ChatGPT Academic 1 万→10 万 形成 OpenAI 企业版 + 零售版 + 学术界 三向实战) - 🟡 打击一起位于柬埔寨的诈骗犯罪活动:OpenAI 打击利用 ChatGPT 配合投资 / 交友 / 赌博 / 冒充的柬埔寨团伙 = OpenAI 安全实战立标(继 7-22 OpenAI 黑客事件 + jay 21:07 CVE-2026-22778 + HF OpenAI rogue agent 17,600 次后第 4 件) - 🟡 DeepSeek V4-Flash-0731 arXiv:2607.23193(Simon Willison 7-31 8-1 1003 同步):3040 亿参数 = 167GB,Hugging Face 同步发布,v33 未单独立目。= DeepSeek V4-Flash 主线 3 国内开源 frontier 立标(承接 v33 §3.3 GLM-5.2 + Kimi K3 双锚 + DeepSeek V4-Flash 第三锚形成 7-31 evening 8-2 早上中国系主权开源 frontier 立基础三件套)

与活文档现有脉络的关系: 与 v33 §2.140 OpenAI 7-30 NEW 4 件集中 + 10 亿 ChatGPT 用户 + Opus 5 远超 Fable 5 + AlphaFold 团队解散 = 8-2 早上 OpenAI 5 件 net-new(数学十项 + abundant intelligence + 欧洲合规 + Univé + 诈骗打击)= v34 OpenAI 主力续立 5 件 + DeepSeek V4-Flash 旁证 1 件。AlphaFold 团队解散 7-30 旁证 + Mythos Preview 7-29 沿用 + OpenAI 数学十项 8-2 = 「DeepMind + Anthropic + OpenAI 三家学术立基础 7-29~8-2」三向实证。

建议归入: §2.140 扩展子节(新增 OpenAI 8-2 早 5 件 + DeepSeek V4-Flash arXiv:2607.23193 立标级候选);§3.3 国内主线焦点扩展(DeepSeek V4-Flash 加入主权开源 frontier 三锚)。


增量 3 · DeepMind 8-2 早 5 件集中 = Gemini Robotics 2 五件套 + Lyria 3.5 + Genesis Mission + 3.6 Flash 三件套同步推

来源: - inbox/stephen/2026-08-02-1003-news-deepmind-news.md(DeepMind 官方 RSS 8-2 1003 CST 5 件) - 间接: inbox/stephen/2026-08-02-1005-news-yt-deepmind.md(Gemini Robotics 2 YT 五连)+ inbox/stephen/2026-08-02-1004-news-google-ai.md(Google AI 8-2 1004 5 件)

要点(5 件 + 5 件 Google AI + 5 件 DeepMind YT = 15 件): - 🔴 Gemini Robotics 2 全身体智能(v33 §2.138 主线 7 VLA 立标级 + v33 §2.141 frontier lab × 学术 第四维续立)= 8-2 早上 YT 五连立标(机器人协同作业 + 全身控制任务 + 高难度灵巧操作 + 智能全身控制 + 这是 Gemini Robotics 2) - 🟡 Gemini Robotics ER 2 推理:视频理解 + 任务编排 + 多机器人协作 = v33 沿用 + ER 2 与 On-Device 2 配套 DeepMind 机器人路线 VLA + 推理 + 端侧 + 多机器人 四位一体闭环(沿用 v33 §2.138) - 🟡 Lyria 3.5 音乐生成模型:Google Flow Music 中推出,音乐性 + 歌词 + 人声 + 创意控制 = DeepMind 音乐 AI 立标 + 与 v33 Gemini Robotics 2 主线 7 VLA 形成「DeepMind 多模态 × 内容生成 × 物理 AI」三栖。与 v33 §2.108 Genesis Mission $40M 科研经费 + AlphaFold 团队解散 7-30 形成「DeepMind 8-2 早上科研 vs 产业 vs 内容 三栖同步」 - 🟡 Genesis Mission $40M:Google 向 Genesis Mission 承诺 4000 万美元 AI tokens + credits = v33 沿用 §2.108(8-2 早上重发=续立) - 🟡 Gemini 3.6 Flash + 3.5 Flash-Lite + 3.5 Flash Cyber 三件套:8-2 早上 DeepMind 官方 RSS 标题列出 = 8-2 net-new 立标(v33 §2.108 「推出 Gemini 3.5 Flash Cyber」7-30 沿用 + 8-2 早上升级 3.6 Flash + 3.5 Flash-Lite)= Gemini 模型家族 8-2 升档(其中 3.6 Flash 是主模型 + Flash-Lite 是轻量 + Flash Cyber 是网络安全垂直) - 🟡 Google AI Gemini API Managed Agents 8-1/8-2 升级(Google AI 8-2 1004):3.6 Flash + hooks + 更多更新 = Google AI 企业版 Managed Agents 立标(与 v33 §2.140 OpenAI GPT-Realtime 7×24 零售 + ChatGPT Academic + avatarin 形成「OpenAI vs Google AI」企业版 4 件双向对位) - 🟡 Google AI Search 3 件(8-2 1004):AI Mode 现实世界 5 招 + 晚宴 5 招 + Galaxy Unpacked 2026 三件 = Google AI Search 8-2 续立(沿用 v33 §2.108 Google Search AI Mode)

与活文档现有脉络的关系: 与 v33 §2.138 DeepMind Gemini Robotics 2 三件套 + 主线 7 VLA + 主线 8 推理 + 主线 9 端侧 = 8-2 早上 DeepMind 5 件 + Google AI 5 件 + DeepMind YT 5 件 = 15 件,其中 Gemini Robotics 2 五连 + Lyria 3.5 + 3.6 Flash 三件套 = 8-2 net-new 立标 3 件(Lyria 3.5 + 3.6 Flash + Managed Agents 升级)。

建议归入: §2.138 扩展子节(新增 Lyria 3.5 + Gemini 3.6 Flash + 3.5 Flash-Lite + 3.5 Flash Cyber + Managed Agents 升级);§2.108 修订候选(Gemini 3.6 Flash 升档)。


增量 4 · Anthropic 8-2 早 5 件 = 全部沿用 v33 · 验证 v33 frontier lab × 安全工程 第 5 次协同披露 + Cognizant 8-2 续立

来源: - inbox/stephen/2026-08-02-1003-news-anthropic-news.md(Anthropic 官方 RSS 8-2 1003 CST 5 件,全部为 v33 沿用件) - 间接: inbox/jay/2026-08-02-1003-rss-import-ai.md(Import AI 466 「机器人领域苦涩教训」+「AI 完成长达一周编程任务」+「OpenAI 意外 AI 黑客」沿用)

要点(5 件): - 🔴 调查我们网络安全评估中的三个真实事件(Anthropic 8-2 1003 标题 1)= v33 §2.142 主线沿用 + frontier lab × 安全工程 第 5 次协同披露(承接 v33 §3.2 争议 119 + §4.1 开放问题 219)= 8-2 续立 - 🔴 使用 Claude 发现密码学弱点(Anthropic 8-2 1003 标题 2)= v33 §2.142 沿用(承接 Mythos Preview HAWK 7-28 + AES 7-29 + 思维链 7-30 + 三起真实事件 7-30) - 🟡 我们对开放权重模型的立场(Anthropic 8-2 1003 标题 3)= v33 §2.142 沿用(承接 Dario Amodei 7-29 周末博客 + 开放权重模型立场 7-29) - 🟡 扩展我们与 Cognizant 的合作(Anthropic 8-2 1003 标题 4)= v33 §2.142 沿用(承接 Cognizant 7-30 续立 8-2 morning) - 🟡 推出 Claude Opus 5(Anthropic 8-2 1003 标题 5)= v33 §2.140 沿用(承接 Opus 5 远超 Fable 5 头对头新立标 7-31)

与活文档现有脉络的关系: 8-2 早上 Anthropic 5 件全部为 v33 沿用件,这是 v33 §2.142 frontier lab × 安全工程 第 5 次协同披露 + Anthropic 安全工程 第 5 件披露 的 8-2 morning 验证。三件套(HAWK 7-28 + AES 7-29 + 思维链 7-30 + 三起真实事件 7-30 + Claude Opus 5 7-30 + Cognizant 7-30)全部于 8-2 早上同步出现在官方 RSS,无 net-new 立标

建议归入: §2.142 沿用(无需修订)。


增量 5 · TLDR AI 8-1 头条 Inkling-Small 立基础 + GPT-5.6 价格下调 8-2 续立 = Thinking Machines 小模型立标 + OpenAI 价格战续立

来源: - inbox/stephen/2026-08-02-1004-news-tldr-ai.md(TLDR AI 8-2 1004 5 件头条)

要点(5 件头条): - 🔴 7-31 Inkling-Small + GPT-5.6 价格下调 + Gemini Robotics 2:TLDR AI 7-31 头条 = Thinking Machines Inkling-Small 沿用 v33 §2.108(HF blog thinkingmachines-inkling)+ GPT-5.6 价格下调 + Gemini Robotics 2 续立。Inkling-Small 是 Thinking Machines 首个开放小模型立标,与 v33 §2.108 Mythos Preview 7-29 形成 Thinking Machines 沿用 + 模型立基础 双向 - 🟡 7-30 OpenAI 登顶 ARC-AGI-3 + GPT-5.6 效率提升 + AlphaFold 团队解散:TLDR AI 7-30 头条 = v33 §2.140 沿用(OpenAI ARC-AGI-3 三倍设置 7-30 + GPT-5.6 frontier intelligence efficiency 7-30 + AlphaFold 团队解散 7-30) - 🟡 7-29 AI 减速协议 + 个人超级智能访问权 + Grok Build Mode:TLDR AI 7-29 头条 = v33 §2.108 沿用(Sam Altman singularity 7-29 + 个人超级智能访问权 7-29) - 🟡 7-28 Anthropic 谈开源权重 + Kimi 发布 K3 权重 + MAI Cyber 模型:TLDR AI 7-28 头条 = v33 §2.108 沿用(Anthropic 7-29 开放权重立场 + Kimi K3 立基础 + Microsoft MAI Cyber) - 🟡 7-27 Claude Opus 5 + OpenAI 黑客事件内幕 + NVIDIA 开源权重:TLDR AI 7-27 头条 = v33 §2.108 沿用(Anthropic Opus 5 + OpenAI 黑客事件 7-22 + NVIDIA 开源权重 7-27)

与活文档现有脉络的关系: TLDR AI 8-2 1004 抓取的 5 件头条全部为 v33 沿用件(7-27 ~ 7-31 头条)。无 8-2 早上 TLDR AI net-new 头条。承接 v33 §6.1 Commentary 30 中 tldr.tech 5 件 URL(7-22 / 7-23 / 7-24 / 7-28 / 7-29)。

建议归入: §2.108 沿用(无需修订)。


增量 6 · HF Blog 8-2 早 5 件 + Interconnects 8-2 早 5 件 = 中国系学术侧 GPU 管理 + OlmoEarth + Cosmos-H-Dreams 立标 + GLM-5.2 step-change-for-open 沿用

来源: - inbox/stephen/2026-08-02-1004-news-hf-blog.md(HF Blog 8-2 1004 5 件) - 间接: inbox/flyp/2026-08-02-1002-rss-interconnects.md(Interconnects 8-2 1002 5 件)

要点(5 + 5 件): - 🟡 GPU 管理:为何闲置 GPU 成了新的"停飞飞机"(Dharma-AI) = HF Blog 8-2 早上 net-new(v33 未单独立目)= GPU 资源管理立标(与 v33 §3.1 TGI EOL 2026-03-21 6→5 框架 + LMCache Q2 Roadmap 形成推理基础设施侧 8-2 三件套) - 🟡 OlmoEarth 平台:行星尺度的地理空间推理 + OlmoEarth Infrastructure(HF Blog 8-2 1004)= v33 §2.108 沿用 + AllenAI 8-2 早上续立(承接 v33 HF blog 14 中 allenai/olmoearth + allenai/olmoearth-infrastructure 8-2 重发) - 🟡 LFM2.5-Encoders:CPU 上的快速长上下文推理(HF Blog 8-2 1004)= v33 §2.108 沿用(承接 v33 HF blog 14 中 LiquidAI/lfm2-5-encoders) - 🟡 NVIDIA Cosmos-H-Dreams:将实时生成式仿真引入手术机器人(HF Blog 8-2 1004)= HF Blog 8-2 早上 net-new 立标 = NVIDIA Cosmos 平台向医疗机器人延伸 + 实时生成式仿真 + 手术机器人垂直(与 v33 §2.138 Gemini Robotics 2 全身 humanoid + 主线 7 VLA 形成「医疗 vs 通用」物理 AI 飞轮双向) - 🟡 前沿实验室 Agent 入侵剖析:2026 年 7 月事件的技术时间线(HF Blog 8-2 1004)= v33 §2.115 沿用(承接 v33 §2.115 OpenAI rogue agent 17,600 次 + HF agent-intrusion-july-2026) - 🟡 Interconnects 8-2 1002 5 件(flyp):开源模型回顾 podcast + Kimi K3 open-weights escalation + 6 months to live for open models + Artifacts 22(Zyphra + Cohere + Poolside)+ GLM-5.2 step-change-for-open = 全部 v33 沿用(承接 v33 §2.108 GLM-5.2 立标级 + §3.3 国内主线 + Commentary 30 interconnects 4 件) - 🟡 Cameron Wolfe 8-2 1000 5 件(flyp):Agentic 世界模型 + Agentic RL + Agent 评估 + RL scaling laws + LLM 基准 = flyp multimodal-e1prep §2 反方候选候选池补料

与活文档现有脉络的关系: HF Blog 8-2 早上 5 件中 3 件沿用 + 2 件 net-new(GPU 管理 Dharma-AI + Cosmos-H-Dreams 手术机器人)= 8-2 早上 HF Blog 2 件 net-new。Interconnects 8-2 早上 5 件全部沿用。

建议归入: §2.108 修订候选(GPU 管理 + Cosmos-H-Dreams 加入)。§2.138 修订候选(Cosmos-H-Dreams 手术机器人)。


增量 7 · Karpathy 7-26 辟谣「离开 Anthropic」+ Sam Altman singularity + OpenAI 数学十项 + Mythos Preview 对位 = 学术侧 8-2 早上第 4 立基础

来源: - inbox/stephen/2026-08-02-0910-news-x-vip-radar.md(X 名人雷达 8-2 0910 · 7 件 + Karpathy 7-26 辟谣) - 间接: inbox/jay/2026-08-02-1000-rss-raschka.md(Sebastian Raschka 8-2 1000 5 件)

要点(8 件): - 🟡 Karpathy 7-26 发推辟谣「离开 Anthropic」传闻(X-VIP-radar #1):有大事应发长帖而不是改 bio = Karpathy bio Anthropic 字段移除 68 天闪离 v33 沿用 + 7-26 辟谣首例公开回应(承接 v33 §2.108 「Karpathy bio 68 天闪离」+ 8-2 早上 Karpathy 公开澄清=后续 Anthropic 关系定位新立基础) - 🟡 Sam Altman 7-27 「GPT-5.6 Sol is literally all I need, OpenAI could stop shipping new models tomorrow」(X-VIP-radar #2)= v33 §2.108 沿用(Sam Altman singularity 7-29 podcast + ChatGPT Work 7-26) - 🟡 Andrew Ng 7-17 与 Cerebras 合作上线短课《Fast LLM Inference with Cerebras》(X-VIP-radar #3)= v33 未单独立目 + Andrew Ng 攻略候选(承接 v33 §2.108 Andrew Ng OpenWorker + Coursera $100M) - 🟡 Ethan Mollick 本周连发 GPT-5.6 Pro > Fable 5 Ultracode 评测(X-VIP-radar #4)= v33 §2.108 沿用(Mollick 7-28~30 + Substack 文章) - 🟡 OpenAI 7-29 ChatGPT for Academic Researchers + Sign in with ChatGPT beta(X-VIP-radar #5)= v33 §2.140 沿用(OpenAI ChatGPT Academic 1 万→10 万) - 🟡 Google DeepMind 7-30 Gemini Robotics 2 / ER 2 / On-Device 2 三件套 + Apptronik Apollo 2 同台演示(X-VIP-radar #6)= v33 §2.138 沿用 - 🟡 LeRobotHF 7-24 上线 lerobot-annotate:LeRobot 数据集格式加入完整语言标注(X-VIP-radar #7)= HF 7-24 net-new 立标(v33 未单独立目)= LeRobot 数据标注立基础(与 v33 §2.137 HiFi-UMI 主线 7 VLA 立标级 + ACE-Data-0 8-2 立基础 = 具身数据标注三件套) - 🟡 Sebastian Raschka 8-2 1000 5 件(jay):控制 LLM 中的推理强度 + 使用本地编码 Agent + LLM 研究论文 2026 part1 + LLM 架构最新进展(KV Sharing / mHC / 压缩注意力)+ 我理解 LLM 架构的工作流程 = v33 §2.108 沿用(承接 v33 Commentary 30 Raschka 5 件)

与活文档现有脉络的关系: X-VIP-radar 8-2 0910 7 件 = 5 件沿用 + 2 件 net-new(Karpathy 7-26 辟谣首例公开回应 + LeRobotHF 7-24 lerobot-annotate 立基础)= 8-2 早上 X-VIP-radar 2 件 net-new

建议归入: §2.108 修订候选(Karpathy 7-26 辟谣);§2.137 修订候选(LeRobotHF 7-24 lerobot-annotate 加入具身数据标注)。


二、值得警惕的矛盾或待核实说法

矛盾 1 · HF Daily 8-2 票榜 Metis 翻倍级 254▲ vs v33 §2.139 Metis 7-31 88▲ = 单日跨日 +113 增长 127% 触发飞轮 vs 5 实例协同饱和验证

矛盾点: v33 §2.139 7-31 票榜 Metis 88▲(7-31 跨日 +18 续立)+ 8-2 早上 254▲(单日跨日 +166 增长 188% 触发飞轮)= Metis 8-2 早上已超 Gemini Robotics 2 / OpenAI 数学十项等同等级飞轮。7-31 evening 棒 5 实例 5/5 协同饱和度验证(全部看过 + 全部确认),但 8-2 早上票数跨日翻倍级需要 5 实例再次验证。

待核实: 1. Metis 254▲ 是否被外部信号源(X / GitHub / Hugging Face)同步验证 2. Memory Decoder at Scale arXiv:2607.27919 与 Metis arXiv:2607.26760 是否同向补充 3. 8-2 早上「memory 立标级候选」双线(Metis + Memory Decoder)是否构成「2026 H2 memory 三联立」第 2 例

建议归入: §3.2 争议新增 1 条(候补)·§4.1 开放问题新增 1 条(候补)。

矛盾 2 · DeepMind 8-2 早上 Gemini 3.6 Flash + 3.5 Flash-Lite + 3.5 Flash Cyber 三件套 vs v33 §2.108 推出 Gemini 3.5 Flash Cyber 7-30 = 升档 vs 沿用 边界

矛盾点: v33 §2.108 「推出 Gemini 3.5 Flash Cyber」7-30 + 8-2 早上「推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber」= 3.6 Flash 是 8-2 net-new 主模型 + 3.5 Flash-Lite 是 8-2 net-new 轻量 + 3.5 Flash Cyber 是 7-30 沿用。三件套整体是 8-2 net-new(标题里写 3 件),但实质 3.5 Flash Cyber 是沿用。

待核实: 1. 3.6 Flash 与 3.5 Flash 主版本号升档的具体性能指标(Gemini API Managed Agents 升级 8-1/8-2) 2. 3.5 Flash-Lite 与 3.5 Flash 主模型相对位置 3. 3.5 Flash Cyber 与 v33 §2.108 Mythos Preview 7-29 + Anthropic 密码学 7-29 + 「Mythos vs GLM-5.2 Semgrep」对位关系

建议归入: §2.108 修订候选 + §3.2 争议候补。

矛盾 3 · OpenAI 8-2 早上「构建丰沛的智能」全栈战略级表述 vs v33 §2.140 「GPT-5.6 Luna 80% 降幅 + Terra 20% 降幅」价格战 = 战略表述 vs 价格动作

矛盾点: v33 §2.140 7-30 OpenAI 价格战 Luna 80% 降幅 + Terra 20% 降幅 + 7-27 Sam Altman 「GPT-5.6 Sol is literally all I need」 + 8-2 早上 OpenAI Index「构建丰沛的智能」全栈方法让先进 AI 更强大、更经济、更广泛可用 = OpenAI 8-2 战略表述沿用 7-27~7-30 价格战 + Sol GPU kernel 自优化 + speculative decoding 提速 15%+ 已有信号,文字上 8-2 早上是「战略总结」而非 net-new 动作。与 v33 §3.2 争议 117 「DeepMind Gemini Robotics 2 vs TurboVLA / HumanCLAW 同一时间节点三家押注同一方向」头对头缺形成「OpenAI 价格战略 vs DeepMind 物理 AI 飞轮」双向对位但缺 head-to-head。

待核实: 1. 8-2 早上「abundant intelligence」是否包含具体产品 / 合作 / 价格动作(目前只是表述) 2. 与 v33 §2.140 GPT-5.6 价格战 Luna 80% 降幅 + Terra 20% 降幅关系(战略表述 vs 价格动作) 3. Sam Altman 8-1 ~ 8-2 是否有 net-new 推文 / 采访对应

建议归入: §3.2 争议候补。

矛盾 4 · HF Daily 8-2 #4 Frontis-MA1 162▲ vs v33 §2.130 Lilian Weng Harness P0 + MSR SkillOpt 静态 = RSI 三联立信号待核实

矛盾点: 8-2 早上 Frontis-MA1 arXiv:2607.28568 162▲(递归自我改进 AI4AI 模型训练)= 与 v33 §2.130 Lilian Weng Harness P0(递归自我改进工程)+ MSR SkillOpt 静态训练参数 vs EvoLib 持续演进知识库「静态 vs 持续」形成「RSI 三联立」。但 Frontis-MA1 162▲ 是否实际为 RSI vs 已有 Harness 体系补充,需核实。

待核实: 1. Frontis-MA1 与 Lilian Weng Harness 的具体方法差异(静态 harness vs AI4AI 训练) 2. MSR SkillOpt + EvoLib vs Frontis-MA1 head-to-head 3. 「RSI 三联立」概念是否经实证

建议归入: §2.130 修订候选 + §3.2 争议候补 + §4.1 开放问题候补。

矛盾 5 · Karpathy 7-26 辟谣「离开 Anthropic」vs v33 §2.108 「Karpathy bio 68 天闪离」= 辟谣 vs 闪离事实

矛盾点: v33 §2.108 「Karpathy bio Anthropic 字段移除 68 天闪离」+ 8-2 早上 X-VIP-radar 「Karpathy 7-26 发推辟谣『离开 Anthropic』传闻」= 闪离事实(沿用 7 月 + 之前)vs 辟谣(7-26 公开回应)。Karpathy 表述「有大事应发长帖而不是改 bio」= 闪离真实原因(若有)应以长帖披露 + 当前 bio 移除无大事

待核实: 1. Karpathy 7-26 推文是否针对 v33 §2.108「68 天闪离」具体回应 2. Karpathy 当前与 Anthropic 关系(独立 / 顾问 / 创业 / 学术) 3. 是否后续 Karpathy 长帖披露「真实闪离原因」

建议归入: §2.108 修订候选 + §3.2 争议候补。


三、可引用的 arXiv 号列表(本期新增 8 件 net-new 立标候选)

arXiv 号 标题(中文) 票数 来源
arXiv:2607.28618 AskChem:以声明为中心的化学文献合成基础设施 290▲ HF Daily 8-2 #1
arXiv:2607.28227 Qwen-UI-Agent 技术报告:迈向以真实世界为中心的下一代基础 GUI Agent 278▲ HF Daily 8-2 #2
arXiv:2607.26760 Metis:记忆基础模型(8-2 翻倍级) 254▲(v33 沿用) HF Daily 8-2 #3
arXiv:2607.28568 Frontis-MA1:面向机器学习工程中递归自我改进的 AI4AI 模型训练 162▲ HF Daily 8-2 #4
arXiv:2607.28624 PhiZero:围绕物理语言构建的世界模型 156▲ HF Daily 8-2 #5
arXiv:2607.26811 DistillAlign:自回归视频蒸馏中模式覆盖与模式寻求的协同 88▲ HF Daily 8-2 #6
arXiv:2607.27380 VideoCoCo:通过 Agentic 双引擎系统实现物理一致视频生成的代码即思维链 64▲ HF Daily 8-2 #7
arXiv:2607.27919 Memory Decoder at Scale:预训练的参数化长期记忆 48▲ HF Daily 8-2 #8
arXiv:2607.28595 Beacon:理解何时以及如何进行 Agentic 视觉推理 46▲ HF Daily 8-2 #9
arXiv:2607.25294 CLBench-V(8-2 续立) 44▲(v33 沿用) HF Daily 8-2 #10
arXiv:2607.26497 BM25 Wins at Scale:RAG 范式的可扩展性研究 41▲ HF Daily 8-2 #11
arXiv:2607.28022 Flux-OPD:基于演化上下文的在策略蒸馏 39▲ HF Daily 8-2 #12
arXiv:2607.27616 MPIE-Bench:解剖学合理的多人交互编辑基准 37▲ HF Daily 8-2 #13
arXiv:2607.28625 ACE-Data-0:以人为中心的环境式捕获作为具身数据引擎 34▲ HF Daily 8-2 #14
arXiv:2607.27816 Beyond Borrowed Histories:面向交互式角色扮演评估的个性化用户模拟 30▲(paper_cards/679) HF Daily 8-2 #15

DeepSeek V4-Flash-0731(沿用 Simon Willison 7-31): - arXiv:2607.23193(paper_cards/688 已建卡)·DeepSeek V4-Flash-0731 · 3040 亿参数 · 167GB · Hugging Face 同步发布 · v33 未单独立目

OpenAI 数学十项进展(OpenAI Index 8-2): - (无 arXiv 号 · 综述类 · https://openai.com/index/ten-advances-in-mathematics) - 与 Anthropic Mythos Preview 7-29「使用 Claude 发现加密弱点」沿用形成「OpenAI 数学十项 vs Anthropic 密码学」双向对位

总计 15 件 arXiv(本期 net-new 立标候选 12 件 + 2 件续立/翻倍 + 1 件沿用)+ 1 件 OpenAI 综述 = 16 件


四、本期检查过的来源

inbox/jay/ 8-2 早上 11 件(全查)

  • 2026-08-02-1000-rss-bytebytego.md · 5 件 bytebytego(OpenAI ChatGPT Agent 循环 + NVIDIA 开源模型 + DoorDash/Instacart/Uber Eats LLM 集成 + 幂等性 + 招聘)= v33 §2.108 沿用 1 件(ChatGPT Agent 循环)+ 4 件 net-new 候选(NVIDIA 开源模型 / DoorDash 等 3 家 LLM 集成 / 幂等性 / 招聘)
  • 2026-08-02-1000-rss-raschka.md · 5 件 Raschka(控制 LLM 推理强度 + 本地编码 Agent + LLM 研究论文 2026 part1 + LLM 架构最新进展 + 我理解 LLM 架构工作流程)= v33 §2.108 沿用 5 件
  • 2026-08-02-1001-rss-cool-papers.md · Cool Papers cs.CL 5 件(AskChem + 引导 LLM 断言自身意识 + 多采样少反思 + Frontis-MA1 + ORCA-bench)= 与 HF Daily 8-2 #1 #4 重合(AskChem + Frontis-MA1)
  • 2026-08-02-1001-rss-nathan-benaich.md · Nathan Benaich 5 件(欧洲 AI 主权 + State of AI 2026-05 + RAAIS 2026 + State of AI 2026-04 + Air Street Fund III)= v33 §2.108 沿用 4 件 + Air Street Fund III 2.32 亿美元 net-new 候选
  • 2026-08-02-1001-rss-simon-willison.md · Simon Willison 5 件(引用 Greg Brockman + datasette-apps 0.2a0 + 数学与理论计算机科学十大进展 + deepseek-ai/DeepSeek-V4-Flash-0731 + Stateless MCP)= 1 件 OpenAI 数学十项 net-new + 1 件 DeepSeek V4-Flash net-new + 3 件沿用
  • 2026-08-02-1002-rss-cool-papers-ir.md · Cool Papers cs.IR 5 件(TCA-SIR + CCFormer + VIG-RL + LLM 驱动生成式解耦 + 基于反馈的策略发现)= v33 未单独立目 · 5 件 net-new 候选(均不属于 ai-industry 主题核心,归入 llm-application 或 rag 主题)
  • 2026-08-02-1002-rss-lilian-weng.md · Lilian Weng 5 件(Harness 工程 + Scaling Laws + 我们为何思考 + Reward Hacking + LLM 外在幻觉)= v33 §2.108 沿用 5 件(Harness 工程 P0 + Scaling Laws P0)
  • 2026-08-02-1003-rss-import-ai.md · Import AI 5 件(466 机器人苦涩教训 + 465 开源 vs 闭源 + 464 Fable 写 GPU 内核 + 463 自我改进机器人 + 462 超级说服)= v33 §2.108 沿用 5 件
  • 2026-08-02-1003-rss-msr-blog.md · MSR Blog 5 件(Echoverse + EvoLib + SymCrypt Rust + Aurora 1.5 + Flint)= v33 §2.141 沿用 5 件
  • 2026-08-02-1004-rss-yt-karpathy.md · Karpathy YT 5 件(我如何使用 LLM + 深入理解 LLM + GPT-2 + Tokenizer + 1 小时讲座)= v33 §2.108 沿用 5 件
  • 2026-08-02-1005-rss-yt-fireship.md · Fireship YT 5 件(Anthropic 杀死独立开发者 + 史上最有趣的 hack + 开源权重 AI 2.8 万亿参数 + 120 亿美元创业公司 + OpenAI 起诉)= v33 未单独立目 · 5 件 net-new 候选(独立开发者讨论 + 开源权重 2.8 万亿参数 + 120 亿美元创业公司 + OpenAI 起诉)

inbox/tom/ 8-2 早上 3 件(全查)

  • 2026-08-02-0900-hf-daily-2026-08-02.md · HF Daily 8-2 15 件 = 本期最重要的 1 件(已在增量 1 详述)
  • 2026-08-02-1004-rss-yt-yannic-kilcher.md · Yannic Kilcher YT 5 件(全自动男性说教者 + 圣诞直播 + 节日直播 + TiDAR + Titans)= v33 未单独立目 · 5 件 net-new 候选(TiDAR + Titans 论文解读)
  • 2026-08-02-1005-rss-yt-lex-fridman.md · Lex Fridman YT 5 件(#499 Gary Gallagher + #498 罗马帝国 + #497 物理学最大谜团 + #496 FFmpeg + #495 维京人)= v33 未单独立目 · 5 件非 ai-industry 主题核心

inbox/flyp/ 8-2 早上 4 件(全查)

  • 2026-08-02-1000-rss-cameron-wolfe.md · Cameron Wolfe 5 件(Agentic 世界模型 + Agentic RL + Agent 评估 + RL scaling laws + LLM 基准)= v33 未单独立目 · 5 件 net-new 候选(均属于 agent / llm-application 主题,flyp multimodal-e1prep §2 反方候选补料)
  • 2026-08-02-1002-rss-interconnects.md · Interconnects 5 件(开源模型回顾 podcast + Kimi K3 + 6 months to live + Artifacts 22 + GLM-5.2 step-change)= v33 §2.108 沿用 5 件
  • 2026-08-02-1004-rss-yt-two-minute-papers.md · Two Minute Papers YT 5 件(Kimi K3 经济学 + Claude 揭示 AI 问题 + Anthropic 发现不该存在 + Minecraft + DeepSeek 加速技巧)= v33 §2.108 沿用 2 件(Kimi K3 + DeepSeek V4)+ 3 件 net-new 候选
  • 2026-08-02-1005-rss-yt-ai-explained.md · AI Explained YT 5 件(GPT-6 失控 + 模型大爆发 + Fable 5 vs GPT 5.6 + Fable 封禁 + Fable 5 319 页)= v33 §2.108 沿用 3 件(Fable 5 vs GPT-5.6 Sol + Claude Fable 封禁)+ 2 件 net-new 候选(GPT-6 失控讨论 + Fable 5 319 页完整解析)

inbox/spark/ 8-2 早上 3 件(全查)

  • 2026-08-02-1001-rss-gradient-flow.md · Gradient Flow 5 件(专用 AI 越来越容易 + 大型 AI 实验室 vs 自有数据 + 开源模型发布清单 + 数据中心亏损 + 三款新模型信号)= v33 §2.108 沿用 3 件 + 2 件 net-new 候选(数据中心亏损算式 + 三款新模型)
  • 2026-08-02-1003-rss-chip-huyen.md · Chip Huyen 5 件(AI 应用常见陷阱 + Agent + 生成式 AI 平台 + 个人成长 + 900 个开源 AI 工具)= v33 未单独立目 · 5 件 net-new 候选(均属于 llm-application 主题)
  • 2026-08-02-1005-rss-yt-3blue1brown.md · 3Blue1Brown YT 5 件(64 块方糖 + 交叉熵 + 100 条随机弦 + 英语熵 + 完美编码)= v33 未单独立目 · 5 件非 ai-industry 主题核心

inbox/stephen/ 8-2 早上 11 件(全查)

  • 2026-08-02-0910-news-x-vip-radar.md · X 名人雷达 7 件(已在增量 7 详述)
  • 2026-08-02-1003-news-anthropic-news.md · Anthropic 5 件(已在增量 4 详述 · 全部 v33 沿用)
  • 2026-08-02-1003-news-deepmind-news.md · DeepMind 5 件(已在增量 3 详述)
  • 2026-08-02-1003-news-openai-news.md · OpenAI 5 件(已在增量 2 详述)
  • 2026-08-02-1004-news-bens-bites.md · Ben's Bites 5 件(10 亿 ChatGPT 用户 + Opus 5 远超 Fable 5 + 抓到作弊 + 设计比 Fable 更好 + Inkling)= v33 §2.108 沿用 5 件
  • 2026-08-02-1004-news-google-ai.md · Google AI 5 件(已在增量 3 详述)
  • 2026-08-02-1004-news-hf-blog.md · HF Blog 5 件(已在增量 6 详述)
  • 2026-08-02-1004-news-tldr-ai.md · TLDR AI 5 件(已在增量 5 详述 · 全部 v33 沿用)
  • 2026-08-02-1005-news-yt-anthropic.md · Anthropic YT 5 件(Claude 思考层次 + Fable 5 + 思维语言 + Glasswing + AI 表现情绪)= v33 §2.108 沿用 5 件
  • 2026-08-02-1005-news-yt-deepmind.md · DeepMind YT 5 件(Gemini Robotics 2 五连)= v33 §2.138 沿用 5 件
  • 2026-08-02-1005-news-yt-openai.md · OpenAI YT 5 件(ChatGPT Work 语音 + 100K 学术 + gpt-transcribe + ChatGPT Work 销售营收 + ChatGPT Work 客户研究)= v33 §2.140 沿用 5 件

paper_cards/ 近 3 天新卡抽查

  • 共 30 张新卡(676~688 · 8-2 04:00 batch)· 均属于 rag / agent / llm-infra / multimodal / evaluation 主题,不属于 ai-industry 主题核心
  • paper_cards/679 2607.27816 Beyond Borrowed Histories(本期 HF Daily 8-2 #15 沿用)
  • paper_cards/688 2607.23193 DeepSeek V4-Flash-0731(本期 Simon Willison 8-1 沿用)

work-queue.md 检查

  • 4.1 待写攻略 = drumih/turbo-fieldfare(Gemma 4 26B-A4B inference in ~2 GB of RAM on any M-series MacBook · 周增 +3003 / Stars 3512 · trending)
  • 3) 选题榜未成视频脚本 = 2607.20891(MisKnow-Agent)
  • 5) 富化缺口 = 14 张卡缺 TLDR(cron_s2 覆盖)
  • 6) 待精确分类 = 0 张卡
  • 1) 高价值待深度解读 = 0
  • 2) 待更新/缺失的主题活文档 = 0(全部最新)

work-queue 与 ai-industry 主题间接相关 = drumih/turbo-fieldfare(本地 inference 攻略候选)+ 2607.20891 MisKnow-Agent(已在 v33 §2.130 / §4.1 开放问题中处理)


五、本期判断与建议

主线增量:7 条 + 8 件 arXiv net-new = 中等密度

  • v33(7-31 evening 棒)以 frontier news 沿用为主,真正 net-new 集中在 HF Daily 8-2 票榜 12 件 net-new 立标候选 + OpenAI 数学十项 + DeepMind 3.6 Flash 三件套 + Cosmos-H-Dreams + GPU 管理 Dharma-AI + Karpathy 7-26 辟谣 + LeRobotHF lerobot-annotate + Air Street Fund III 2.32 亿美元 + Frontis-MA1 RSI = 8-2 早上已为 v34 接力棒累积约 15-18 件 net-new 立标候选
  • v34 接力棒(今晚 22:00 evening 棒)预估:在 v33 176 主线 + 145 共识 + 119 争议 + 219 开放问题 基础上,新增 4-6 主线密集 + 5-7 件 frontier/industry 立标 + 10-12 件 net-new 立标候选 + 5-8 件翻倍 / 续立 + 2-3 件矛盾 / 待核实。

矛盾或待核实:5 条(候补进入 §3.2 / §4.1)

  1. Metis 254▲ 跨日翻倍级 vs v33 88▲(跨日 5 实例协同饱和验证)
  2. DeepMind 8-2 三件套 vs v33 7-30 三件套(升档 vs 沿用边界)
  3. OpenAI 「abundant intelligence」战略表述 vs 价格战(战略 vs 动作)
  4. Frontis-MA1 vs Lilian Weng Harness vs MSR SkillOpt(RSI 三联立 head-to-head 缺)
  5. Karpathy 7-26 辟谣 vs v33 bio 68 天闪离(辟谣 vs 闪离事实)

建议

  1. 本期为「待料阶段」,v33 已 7-31 evening 棒 22:00 收官,v34 待今晚 evening 棒(约 12h 后)正式生效
  2. HF Daily 8-2 票榜是 v34 接力棒最大潜在主轴 · 12 件 net-new + Metis 翻倍级 + Frontis-MA1 RSI + Memory Decoder 参数化 memory + BM25 Wins at Scale = 8 件高价值候选
  3. OpenAI 8-2 早上 5 件 = v34 frontier/industry 立标主轴候选(数学十项 + abundant intelligence + 欧洲合规 + Univé + 诈骗打击)
  4. DeepMind 8-2 早上 5 件 + Google AI 5 件 + DeepMind YT 5 件 = v34 物理 AI / 多模态 / 企业版主轴候选
  5. 本期矛盾 / 待核实 5 条建议进入 v34 §3.2 争议候补 + §4.1 开放问题候补

预消化完成。