ai-industry · E1 预消化简报(2026-07-28)

执行:Stephen · 10:20 CST · 承接 knowledge/ai-industry.md v29(7-27 22:00 evening 棒收官 · 151 主线)· 为今晚第 30 版(7-27 22:00 → 7-28 22:00 24h)活文档接力预习备料。 窗口:7-27 22:00 CST(v29 收官)→ 7-28 10:20 CST(本棒执行点)= 12h 已过 + ~12h 剩余。 目的:把 v29 已承接的 151 主线骨架下,7-28 上午批次的"边际增量"提前压缩;不重复 v29 4 主线密集(Anthropic Economic Index connector + AAAI Subramanian 5 实例同步立标 + Simon Willison token 中继市场 + 评论层 → 集中观察型落地 2-3 例)+ 9 件 P0/立标候选增量 + 14 件待人工确认 + 2 件紧急提醒(AAAI 2027 截稿 7-28 + EU AI Act 合规 8-02)。 覆盖:jay/tom/flyp/spark/stephen 5 实例 7-27 evening 后段 + 7-28 上午批次全部读取 + paper_cards 602-614 近 3 天新卡全核。


检查过的来源(共 65+ 项,涵盖 jay/tom/flyp/spark/stephen 7-27 后段 + 7-28 上午批次 + paper_cards 13 张新卡)

jay(7-27 后段 + 7-28 上午,18+ 件)

  • 2026-07-28-0910-news-x-vip-radar(Anthropic Claude Opus 5 + Mollick ARC-AGI-3 30.2% + DeepMind Genesis Mission + OpenAI Presence + Gemini 3.6 Flash + Jim Fan 转 Jensen Huang "GOAT" + Sam Altman + HF 持续开源权重新发布 + LeCun World Modeling with JEPA + Anthropic AI for Science 罕见病资助)
  • 2026-07-28-1000-rss-bytebytego(5 件:NVIDIA 如何为 AI 时代构建开源模型 - Bryan Catanzaro 应用深度学习研究副总裁 + 分布式时钟因果排序入门 + 构建生产 AI Agent 最佳实践 + Roblox 世界模型 + MCP vs A2A vs ACP)
  • 2026-07-28-1000-rss-raschka(5 件:控制 LLM 推理力度 + 本地编程 Agent + LLM 研究论文 1-5 月清单 + LLM 架构新进展 KV Sharing/mHC/Compressed Attention + 理解 LLM 工作流)
  • 2026-07-28-1001-rss-nathan-benaich(5 件:欧洲无法通过租赁方式实现 AI 主权 7-28 net-new + AI 现状 2026-05 + RAAIS 2026 头条 + AI 现状 2026-04 + Air Street Capital $232M Fund III)
  • 2026-07-28-1001-rss-simon-willison(5 件:moonshotai/Kimi-K3 7-27 晚(约 1.56TB HuggingFace 上)+ Mollick 「一份有立场的指南」7-27 + 7-26 relay-market 沿用 + Ruff v0.16.0 + Boris Cherny 引用 Opus 5 「最难被 prompt 注入」)
  • 2026-07-28-1002-rss-cool-papers(cs.CL 5 件 arXiv:22529 Skill Self-Play + 22456 grapheme-kit + 22376 语法书低资源 MT + 22300 阿拉伯文生物医学 NMT + 22218 LLM 与人类创造力评估)
  • 2026-07-28-1002-rss-cool-papers-ir(cs.IR 5 件 arXiv:22529 等 + 邻接)
  • 2026-07-28-1002-rss-lilian-weng(5 件:Lil'Log 索引 - 7-04 Harness 工程 7-04 + Scaling Laws 6-24 + Why We Think + Reward Hacking + LLM 幻觉)
  • 2026-07-28-1003-rss-import-ai(5 件:Import AI 466「机器人领域的苦涩教训 + AI 完成长达一周的编程任务 + OpenAI 意外的 AI 黑客」7-28 新立 + 7-25 沿用 4 件)
  • 2026-07-28-1003-rss-msr-blog(MSR 索引: Rust 密码学 + Aurora 1.5 + Flint 可视化语言 + SkillOpt + Memora)
  • 2026-07-28-1006-rss-yt-karpathy(YouTube 索引沿用)
  • 2026-07-28-1007-rss-yt-fireship(YouTube 索引沿用)
  • 2026-07-28-csdn-hf-transformers-v5-agent-rag-high-value(CSDN 高价值 4 件 = HF Transformers v5.8.0.dev0 缓存系统源码分析 ld326 + 亿级 AI Agent 系统白皮书 + HF Transformers 源码全六篇系列 + 2026 大模型技术栈全解析)
  • 2026-07-28-graphrag-trending(GraphRAG 沿用,新主题独立)
  • 2026-07-28-uv-python-toolchain(UV Python 工具链)
  • 2026-07-28-vllm-pagedattention2(vLLM PagedAttention 2 解析)
  • 2026-07-28-vllm-trt-llm-deploy-csdn(vLLM TensorRT-LLM 部署 CSDN)

tom(7-28 上午,4 件)

  • 2026-07-28T0840-agent-rag-longcontext-radar(8 候选 + 3 高价值: Agentic Context Management arXiv:2607.21503 + Multi-Head Latent Control arXiv:2607.14277 + O-VAD arXiv:2607.18142 + δ-mem Substack 1 件)
  • 2026-07-28-0900-hf-daily-2026-07-28(HF Daily 7-28 15 篇 + AREX 142▲(7-27 139 → 142 +3 持续登顶)+ K12-KGraph 57▲ + ReferTrack 50▲ 新立标 + DataPrep-Bench 40▲ 新立标 + Show Don't Tell 35▲ + SANA-Video 2.0 34▲ + Skill Self-Play 30▲ 新立标 + NVIDIA-labs OO Agents 28▲ + Molt 24▲ + WorkBuddy Bench 24▲ + 主动观察者的考核 25▲ + 用户意图中迷失 22▲ + 颜色透传 19▲ + Self-Supervised Structured Dynamics 18▲ 持续跌出 15 名边缘)
  • 2026-07-28-1006-rss-yt-yannic-kilcher(5 件: mansplainer + 传统圣诞直播 + 传统节日直播 + TiDAR + Titans)
  • 2026-07-28-1007-rss-yt-lex-fridman(5 件: 罗马帝国 #498 + 反物质 #497 + FFmpeg #496 + 维京人 #495 + Jensen Huang #494 NVIDIA 4 万亿)
  • 2026-07-28-rag-e1prep(5 条增量: LAMAR 2607.22042 + δ-mem Substack + Learning on the Job 2607.22157 + LlamaParse Harness + AAAI Subramanian 7 反方验证)
  • 2026-07-28_rag-lite(轻量模式: RAG 8 候选 + 3 高价值 + 2026 生产基线 Hybrid+Reranker + Microsoft Azure Hybrid +21.6%)

flyp(7-28 上午,5 件)

  • 2026-07-28-0955-fluP-dual-critical-read-scaling-native-multimodal-and-ovad(B 级 · 立标级候选 3/5 · arXiv:2607.22043 Scaling Native Multimodal Pre-Training From Scratch Tencent Hunyuan + arXiv:2607.18142 O-VAD 工业视频异常检测 ECCV 2026 = v34 §2.39.x 立标候选新增 4 件中 2 件短审稿)
  • 2026-07-28-1000-rss-cameron-wolfe(沿用 · Cameron Wolfe 五篇主线 7-27 已承接)
  • 2026-07-28-1003-rss-interconnects(沿用 · 5 篇: 开源模型回顾 + Kimi K3 + 6 个月生存期 + artifacts 22 Zyphra/Cohere/Poolside + GLM-5.2 step change)
  • 2026-07-28-1006-rss-yt-ai-explained(沿用)
  • 2026-07-28-multimodal-e1prep(multimodal v34 接力窗口第一棒)

spark(7-28 上午,3 件)

  • 2026-07-28-1002-rss-gradient-flow(5 件:「不止一个旋钮:解读一次开源模型发布」 open-weights-checklist 7-28 新立 + 「AI 可以赢,数据中心却会输」 ai-can-win-while-data-centers-lose 7-28 新立 + 三款前沿级模型 7-28 沿用 + 开源模型将吸收大部分 AI 支出 沿用 + AI 支出到底流向了哪里 沿用)
  • 2026-07-28-1003-rss-chip-huyen(5 件: AI 工程陷阱 + Agent + GenAI 平台 + 个人成长 + 900 个开源 AI 工具)
  • 2026-07-28-1007-rss-yt-3blue1brown(5 件: 64 块方糖 + 交叉熵压缩即智能 Pt2 + 100 条随机弦交点 + 英语的熵 + 完美编码)

stephen(7-27 后段 + 7-28 上午,15+ 件)

  • 2026-07-28-0910-news-x-vip-radar(Anthropic Claude Opus 5 7-24 + Mollick ARC-AGI-3 30.2% 7-24 + DeepMind Genesis Mission $40M 7-22 + OpenAI Presence 7-22 + Gemini 3.6 Flash 7-21 + Jim Fan 转 Jensen Huang GOAT 7-24 + Sam Altman × HF 联合披露安全事件 7-21 + HF 持续开源权重新发布 7-21~27 + LeCun World Modeling with JEPA 7-22 + Anthropic AI for Science 罕见病 7-20)
  • 2026-07-28-1004-news-anthropic-news(5 件: 我们对开放权重模型的立场 + 拓展 Cognizant 合作 + Claude Opus 5 + Project Pilot AI 操控无人机 + Claude Opus 5 系统卡)
  • 2026-07-28-1004-news-openai-news(5 件: AI 如何拓展工作 + ChatGPT Health + Effingham County Project Camellia + 新闻机构 + Advancing National Science)
  • 2026-07-28-1005-news-deepmind-news(5 件: Genesis Mission $40M + Gemini 3.6 Flash + 3.5 Flash-Lite + 3.5 Flash Cyber + 生物韧性 + ATL Saathi)
  • 2026-07-28-1005-news-google-ai(5 件: Galaxy Unpacked 2026 + Search 应用接入 + Google Vids + 视觉搜索 25 周年 + Managed Agents 后台任务 + 远程 MCP)
  • 2026-07-28-1005-news-hf-blog(5 件: NVIDIA Cosmos-H-Dreams + Nunchaku 4-bit + Grabette 机器人 + Dharma-AI + HF 7 月安全事件披露)
  • 2026-07-28-1005-news-tldr-ai(5 件: 7-27 Claude Opus 5 + OpenAI 黑客事件内幕 + NVIDIA 开源权重联署信 + 沿用 4 件)
  • 2026-07-28-1006-news-bens-bites(5 件: 当场抓到作弊 + 设计优于 Fable + Inkling + 如何使用 GPT-5.6 + Grok × Cursor)
  • 2026-07-28-1007-news-yt-{anthropic,deepmind,openai}(各 5 件 YouTube 沿用)
  • 2026-07-27-2245-stephen-coordination-check-evening(完整 evening 协调棒 · 12+ 件 E1 + 9 件 P0 + 14 件待人工确认 + 2 件紧急提醒)

paper_cards(7-26 ~ 7-28 近 3 天 13 张新卡;ai-industry 主题抽样)

  • 7-28 新增 7 张:602-2607-16859(Dataset Distillation by Influence Matching / 主分类 engineering)+ 603-2607-22043(Scaling Native Multimodal Pre-Training From Scratch / 主分类 multimodal / Tencent Hunyuan / flyp dual critical read)+ 604-2607-22375(IDEAgent Agentic Quality-Diversity Search for Research Idea Generation / 主分类 agent)+ 605-2607-22042(LAMAR Open Language-Aware Multilingual Alignment Reranker / 主分类 rag / tom rag-e1prep §1 立标)+ 606-2607-21848(Closing the Loop Training-Free Revisit Consistency / 主分类 multimodal)+ 607-2607-21653(Molt A Scalable PyTorch-Native Training Framework for Agentic Reinforcement Learning / 主分类 agent)+ 608-2607-14277(Multi-Head Latent Control / 主分类 agent / tom radar 7-28 0840 高价值 #2)
  • 7-28 新增 7 张(续):609-2607-12756(VisCo LLM as Intrinsic Encoders for Visual Token Compression / 主分类 multimodal / vLLM KVpop/LCA 邻接)+ 610-2607-22157(Learning on the Job Continual Learning from Deployment Feedback for Frozen-Weights Agents / 主分类 agent / tom 20:40 radar 首选 + tom 0840 雷达 §4)+ 611-2607-22345(Teachy Mini Knowledge-Based Generative Social Robot for Higher Education / 主分类 evaluation)+ 612-2607-22091(Spectral Prior for Reducing Exposure Bias in Diffusion Models / 主分类 multimodal)+ 613-2607-19636(Multimodal Speaker Verification / 主分类 multimodal)+ 614-2607-18198(Three-Body Scattering for Generative Modeling / 主分类 multimodal)+ 615(未查到具体编号)
  • ai-industry 直接相关:arXiv:2607.22043 Scaling Native Multimodal 飞云侧立标级候选 3/5(flyp 0955 dual critical read)+ arXiv:2607.21653 Molt Agent RL 训练框架(Pytorch 原生 + 立标级候选)+ arXiv:2607.22042 LAMAR RAG 跨语种检索偏好修复(tom rag-e1prep §1 立标级候选)+ arXiv:2607.22157 Learning on the Job 冻结权重持续学习(tom 20:40 雷达首选)+ arXiv:2607.22345 Teachy Mini 具身智能 Tutor 边界扩展(tom 20:40 雷达高价值 #2)+ arXiv:2607.14277 Multi-Head Latent Control Agent 决策控制推理侧(tom radar 7-28 0840 高价值 #2)+ arXiv:2607.18142 O-VAD 工业视频异常检测 ECCV 2026(flyp dual critical read)

增量条目(7 条 · 含 v29 续立 + v30 net-new 候选)

增量 1 · ⭐⭐⭐⭐⭐ · Gradient Flow「AI 可以赢,数据中心却会输」 + 「不止一个旋钮」 双立标(v29 已承 Gradient Flow 集中观察型落地 2.0,本场 7-28 新增 2 篇主线立标)

来源:spark 2026-07-28-1002-rss-gradient-flow 5 件全部 · 原文 gradientflow.com/ai-can-win-while-data-centers-lose/ + gradientflow.com/open-weights-checklist/ · v29 §2.114.1 Gradient Flow 集中观察型落地 2.0 已承接基础

要点: - 🟡 Gradient Flow「AI 可以赢,数据中心却会输」:作者观察到 AI 数据中心的"算式":投入资金累积速度远快于任何能证明它合理的经济依据;AI 系统使用量增长,但 capex/opex 累积超过经济回报;信号:AI 经济基础设施的可持续性 vs AI 模型能力提升的脱钩 - 🟡 Gradient Flow「不止一个旋钮:解读一次开源模型发布」:作者主张「开源」已不再预测任何东西了——它曾是可靠判断"模型是否进步"的指标,但当下开源模型 vs 闭源模型不再是单一变量,而是包含数据/工程/路线/团队/算力等的多变量;信号:开源-闭源差距不再是简单二元对立,需多维度评估 - 结构性信号:Gradient Flow 7-27 三款前沿级模型集中观察(§2.114.1 第 1 例)→ 7-28 上午双新立标(数据中心算式 + 开源多旋钮)= 评论层 → 集中观察型落地 第 4-5 例;承接 v29 §2.114.1 + v29 §2.109 主线

与活文档 knowledge/ai-industry.md v29 §2.114.1 的关系: - v29 §2.114.1 已立 Gradient Flow 集中观察型落地 2.0 = 「评论层 → 集中观察型落地」第 1 例 + Nathan Lambert「6 个月生存期」专栏 + Nathan Benaich 5 月报告 - 本场 7-28 上午双新立标 = 「评论层 → 集中观察型落地」第 2-3 例;新立标含「AI 经济基础设施 vs 数据中心算式」与「开源多旋钮」2 个独立子主题 - v30 §2.114 应升档 + 建议合并入 notes/industry/gradient-flow-ai-can-win-while-data-centers-lose-2026.md + notes/industry/gradient-flow-open-weights-checklist-2026.md

建议归入节:knowledge/ai-industry.md §2.114 续接 + §2.114.1 升档 + 新增 §2.115 Gradient Flow 双新立标(AI 数据中心算式 + 开源多旋钮) + §3.1 共识新增第 127 条

arXiv(本节无新立,沿用 v29)


增量 2 · ⭐⭐⭐⭐⭐ · HF Daily 7-28 票榜 5 件 net-new + AREX 142▲ 持续登顶(v29 已承接 HF Daily 7-27 8 件续立/翻倍)

来源:tom 2026-07-28-0900-hf-daily-2026-07-28 15 篇全核 · paper_cards/602-615 13 张新卡 · 旁证 spark 2026-07-28-1002-rss-gradient-flow + flyp 2026-07-28-0955-fluP-dual-critical-read

要点: - 🟡 AREX 142▲(7-27 139 → 142 +3▲ 持续登顶)= AREX 130-140 区间连续 2 周区间 + 单日 +3 续立;arXiv:2607.21461 持续登顶强度足以触发立标级候选升档 - 🟡 K12-KGraph 57▲(7-27 57 → 57▲ 持平高位)· arXiv:2605.09635(教育 LLM 课程对齐知识图谱) - 🟡 ReferTrack 50▲(新立)· arXiv:2607.20061(先指代后跟踪的具身视觉跟踪)= 新立标候选 4/5 - 🟡 DataPrep-Bench 40▲(新立)· arXiv:2607.20465(LLM 作为训练数据准备者的基准)= 新立标候选 4/5(tom 7-28 rag-lite §1 高价值 #2) - 🟡 Show Don't Tell 35▲(新立)· arXiv:2607.21072(在生成像素而非 LLM 文本中评估空间认知) - 🟡 SANA-Video 2.0 34▲(7-27 27 → 34 +7▲ 持续登顶)= flyp v33 §2.39.99 SANA-Video 2.0 立标级证据继续充分加固(已立 arXiv:2607.21553) - 🟡 Skill Self-Play 30▲(新立)· arXiv:2607.22529(通过技能协同进化拓展 LLM 能力边界 · cs.CL 沿用)= 新立标候选 4/5 - 🟡 NVIDIA-labs OO Agents 28▲(7-27 26 → 28 +2▲ 持续登顶)= arXiv:2607.20709(原生 Python 面向对象 Agent) - 🟡 Molt 24▲(新立)· arXiv:2607.21653(面向 Agent RL 的可扩展 PyTorch 原生训练框架)= 新立标候选 4/5(已建 paper_cards/607) - 🟡 Tencent WorkBuddy Bench 24▲(7-27 21 → 24 +3▲)· arXiv:2607.20911(抗污染任务构建的多领域编码 Agent 基准) - 🟡 主动观察者的考核 25▲(7-27 25 → 25▲ 持平)· arXiv:2607.16165 - 🟡 LLM 在不断演化的用户意图中迷失 22▲(7-27 21 → 22 +1▲)· arXiv:2607.20734 - 🟡 通过相机-显示器耦合实现颜色透传 19▲ · arXiv:2607.12746 - 🟡 Self-Supervised Structured Dynamics 18▲(7-27 18 → 18▲ 持平低位)· arXiv:2607.21576 = flyp v34 §3.3 反方 #55 评级升级时机风险持续激活

结构性信号:HF Daily 7-28 票榜 5 件 net-new 续立(ReferTrack + DataPrep-Bench + Show Don't Tell + Skill Self-Play + Molt)+ AREX 142▲ 持续登顶 + SANA-Video 2.0 +7▲ 立标级证据继续充分加固 + ⚠️ SDM 持续 18▲ 跌出前 15 名外 = v29 §2.114.2 续立 + 第 30 版新增 5 件立标级候选

与活文档 v29 §2.114.2 的关系: - v29 §2.114.2 已立 HF Daily 7-27 8 件 net-new(AREX 139▲ + SLAI T-Rex + K12-KGraph + 视觉对比自蒸馏 + 超越相关性中心检索 + SANA-Video 2.0 +6▲ + NVIDIA-labs OO Agents + LLM 在用户意图中迷失 + Tencent WorkBuddy Bench + 主动观察者的考核) - 本场 7-28 上午 5 件 net-new = ReferTrack + DataPrep-Bench + Show Don't Tell + Skill Self-Play + Molt - v30 §2.114.2 应续立 + 新增 5 件立标级候选

建议归入节:knowledge/ai-industry.md §2.114.2 续立 + 新增 §2.114.2.1 HF Daily 7-28 5 件 net-new 立标级候选 + §3.1 共识新增第 128 条

arXiv 号(新立标候选 5 件): - arXiv:2607.20061(ReferTrack 具身视觉跟踪) - arXiv:2607.20465(DataPrep-Bench LLM 训练数据准备者基准) - arXiv:2607.21072(Show Don't Tell 空间认知像素评估) - arXiv:2607.22529(Skill Self-Play 技能协同进化) - arXiv:2607.21653(Molt Agent RL 训练框架)


增量 3 · ⭐⭐⭐⭐⭐ · Nathan Benaich 7-28「欧洲无法通过租赁方式实现 AI 主权」+ Import AI 466 + ByteByteGo NVIDIA 开源模型 = 评论层三栖新立标(v29 已承评论层 → 集中观察型落地 2-3 例)

来源:jay 2026-07-28-1001-rss-nathan-benaich 第 1 条「欧洲无法通过租赁方式实现 AI 主权」7-28 net-new · jay 2026-07-28-1003-rss-import-ai 第 1 条 Import AI 466「机器人领域的苦涩教训 + AI 完成长达一周的编程任务 + OpenAI 意外的 AI 黑客」7-28 net-new · jay 2026-07-28-1000-rss-bytebytego 第 1 条「NVIDIA 如何为 AI 时代构建开源模型」 Bryan Catanzaro 应用深度学习研究副总裁 7-28 net-new · v29 §2.114.1 评论层 → 集中观察型落地 2.0 已承接基础

要点: - 🟡 Nathan Benaich「欧洲无法通过租赁方式实现 AI 主权」:华盛顿能在一夜之间禁用某个模型;问题已不再是 AI 是否安全,而是由谁掌控;信号:AI 主权不只是技术能力,更是部署基础设施控制权;欧洲若仅依赖租赁美国云服务,无法实现 AI 主权 - 🟡 Import AI 466(Jack Clark):「机器人领域的苦涩教训」 + 「AI 完成长达一周的编程任务」 + 「OpenAI 意外的 AI 黑客」 = 三栖同时启动:(a) 机器人(scaling law 在机器人领域的扩展);(b) 长程编程(METR 类任务实现);(c) OpenAI 安全事件(从 v29 HF 7 月安全 + OpenAI × HF 联合披露延伸) - 🟡 ByteByteGo NVIDIA「How NVIDIA Builds Open Models for the AI Era」:Bryan Catanzaro(NVIDIA 应用深度学习研究副总裁)介绍 NVIDIA 开源模型构建、架构设计考量、训练 pipeline;信号:NVIDIA 作为硬件 + 模型一体厂商的开源路线,印证 v29 §2.114.10 Jensen Huang NVIDIA 4 万亿立场 + Jim Fan 转 Jensen Huang "GOAT" - 结构性信号:评论层 3 条 net-new = AI 主权(欧洲) + 长程编程 + 机器人 scaling law + OpenAI 安全事件 + NVIDIA 开源模型 = 评论层 → 集中观察型落地 第 4-5 例;承接 v29 §2.114.1 + v29 §2.114.10

与活文档 v29 §2.114.1 + §2.114.10 + §3.1 共识 126 的关系: - v29 §2.114.1 已立 Gradient Flow 集中观察型落地 2.0 + Nathan Lambert 双 N + Cameron Wolfe 五篇 - v29 §2.114.10 已立 Lex Fridman 7-27 #494 Jensen Huang NVIDIA 4 万亿 + vs LeCun AMI Labs + vs Jim Fan 立场 3.0 - 本场 7-28 上午 3 条评论层 net-new = Nathan Benaich + Import AI 466 + ByteByteGo NVIDIA 开源模型 - v30 §2.114.1 应续立 + §2.114.10 应新增 ByteByteGo NVIDIA 子节 + §3.1 共识新增第 129 条

建议归入节:knowledge/ai-industry.md §2.114.1 续接 + §2.114.10 续接 + 新增 §2.116 评论层三栖新立标(欧洲 AI 主权 + Import AI 466 + ByteByteGo NVIDIA 开源模型)+ §3.1 共识新增第 129 条

arXiv(本节无新立)


增量 4 · ⭐⭐⭐⭐ · flyp 7-28 dual critical read: arXiv:2607.22043 Scaling Native Multimodal + arXiv:2607.18142 O-VAD = v34 §2.39.x 立标候选新增 2 件(v29 已承 flyp multimodal-e1prep v34 准备棒)

来源:flyp 2026-07-28-0955-fluP-dual-critical-read-scaling-native-multimodal-and-ovad(B 级 · 立标级候选 3/5 · 2 件短审稿 + 3 反方硬标签新增 + 1 flyP 反思规则沿用)· flyp 2026-07-28-multimodal-e1prep multimodal v34 接力窗口第一棒 · paper_cards/603 Scaling Native Multimodal + paper_cards/614 Three-Body Scattering 等 7-28 新建卡

要点: - 🟡 arXiv:2607.22043 Scaling Native Multimodal Pre-Training From Scratch —— Haoyuan Wu et al. · CUHK + Tencent LLM Department · 2026-07-24 · 主分类 multimodal · 首次独立解耦 language vs multimodal objective 的 scaling law;固定 compute budget 下拟合 L ∝ C^(-α) compute-optimal law;发现 language 和 multimodal objective 的指数不同;提出 language-multimodal Pareto frontier:沿 Pareto 曲线移动 → 任一 compute budget 可指定"最优 model size + 文本 token 数 + 多模态 token 数"的部署级训练配置 = NMM scaling law 立基础 + Shukor 2025 / Emu3.5 流派(主线 1「统一多模态生成」立基础) - 🟡 arXiv:2607.18142 O-VAD Industrial Video Anomaly Detection through Object-Centric Tracking and Reasoning —— ECCV 2026 accepted · 工业 VAD 主流会议接收 · 免训练的 agentic 框架 · 强调物体状态演化追踪而非通用 VLM 开放域异常检测 = 主线 7「垂直域多模态」邻接工业质检 - 🟡 flyp 7-28 dual critical read 3 反方硬标签新增: - 反方 #57:"NMM scaling law 已被 Shukor 2025 与 Beyond-LLMs 同时建立,本工作的边际贡献是 Tencent 自己的实证 + Pareto frontier 命名,学术增量是否足以开 v34 立标候选需谨慎" - 反方 #58:"compute-optimal allocation 是否对 inference-efficient / vision-token 压缩技术鲁棒?没做 ablation 之前不应直接当作 v34 立标候选" - 反方 #59:"late vs early fusion 没独立对比 → 不能直接说 'native 路线优于 late-fusion'" - 🟡 flyp 反思规则第 21 次适用(沿用 7-13 起连续规则) - 结构性信号:v34 §2.39.x 立标候选新增 4 件中 2 件短审稿(scaling-native-multimodal 立基础 + O-VAD 工业质检)= flyp multimodal-e1prep v34 接力窗口第一棒 · flyp 反思规则第 21 次适用

与活文档 v29 §2.114.6(flyp Cameron Wolfe 双稿 E2 短评)+ multimodal.md v34 的关系: - v29 §2.114.6 已立 flyp 7-27 15:52 Cameron Wolfe Substack 双稿 E2 短评 = 「训练侧 + 检索侧 + 世界模型侧 + Agent Harness」4 联立标层 - multimodal.md v33 已收官;flyp 7-28 multimodal-e1prep v34 准备棒 + dual critical read = v34 续接 - v30 multimodal v34 应续接 + flyp 反思规则第 21 次适用 + 新增 §2.39.x 4 件立标候选中 2 件短审稿

建议归入节:knowledge/multimodal.md v34 §2.39.x 新增 4 件立标候选中 2 件短审稿(scaling-native-multimodal + O-VAD)+ knowledge/ai-industry.md §2.114.6 续接(flyp dual critical read)+ §3.1 共识新增第 130 条

arXiv(新立 2 件):arXiv:2607.22043 + arXiv:2607.18142


增量 5 · ⭐⭐⭐⭐ · Simon Willison 7-27 晚场「moonshotai/Kimi-K3」 + Mollick 「一份有立场的指南」= AI 主权开源 2.0 + 评论层 Mollick 指南反应(v29 已承 Kimi K3 沿用)

来源:jay 2026-07-28-1001-rss-simon-willison 第 1-2 条 moonshotai/Kimi-K3 + 一份有立场的指南:选用哪种 AI 来做事 · 7-27 晚场 Simon Willison 追加发布 · v29 §2.114.1 已承接 Kimi K3 + Nathan Lambert Kimi K3

要点: - 🟡 moonshotai/Kimi-K3 上线 Hugging Face —— Simon Willison 7-27 晚场确认 Kimi K3 模型权重发布 · 2.8 万亿参数 · Hugging Face 上大小约 1.56TB · 「开源权重的升级」(Nathan Lambert 引用沿用) - 🟡 Mollick 「一份有立场的指南:选用哪种 AI 来做事」 —— Simon Willison 7-27 晚场引用 Ethan Mollick 的指南随时间演变 · 一年前全是 ChatGPT 之类 · 现已有更多模型选项;信号:AI 工具选择进入多模型精细化阶段 · 评论层长尾 - 结构性信号:Kimi K3 1.56TB HuggingFace 上线 + Mollick 指南反应 = 主权开源 2.0 + 评论层长尾第 3 例;承接 v29 §2.114.1 + v29 §3.1 共识 126

与活文档 v29 §2.114.1 的关系: - v29 §2.114.1 已立 Kimi K3 主权开源升级 + Nathan Lambert 引用 - 本场 7-27 晚场 Simon Willison 确认 Kimi K3 1.56TB 上线 HuggingFace + Mollick 指南反应 = 增量补强 - v30 §2.114.1 应续接 Kimi K3 HuggingFace 上线 1.56TB + Mollick 指南反应子节

建议归入节:knowledge/ai-industry.md §2.114.1 续接 + 新增 Kimi K3 1.56TB HuggingFace 上线子节 + Mollick 指南反应子节

arXiv(本节无新立)


增量 6 · ⭐⭐⭐⭐ · HF Daily 7-28 AREX 142▲ 持续登顶 + Self-Supervised Structured Dynamics 18▲ 持续跌出 15 名外 = v29 §2.114.2 续立 + v34 §3.3 反方 #55 评级升级时机风险激活(v29 已承 AREX 139 + SDM 18▲ 跌出)

来源:tom 2026-07-28-0900-hf-daily-2026-07-28 AREX 142 +3 + SDM 18▲ 持平 · v29 §2.114.2 已承接基础 · v29 §3.2 争议 109 已承 SDM 跌出风险

要点: - 🟡 AREX 142▲(7-27 139 → 142 +3▲ 单日续立)= arXiv:2607.21461 持续登顶 + 单日 +3 强度足以触发立标级候选升档;承接 v29 §2.114.2 7-27 AREX 139▲ 续立 - 🟡 ⚠️ Self-Supervised Structured Dynamics arXiv:2607.21576(28▲ → 18▲ → 18▲ 单日 +0 持平低位 累计跨日 60▲ 持续跌出前 15 名外)= flyp v34 §3.3 反方 #55「评级升级时机风险」新立标决策持续激活(v33 §2.39.91 P3 → P2 旁证 7-26 单日 14→28▲ 翻倍最大升幅 · 7-27 次日 28→18▲ 单日 -10 跌出前 15 名边缘 · 7-28 三日 18→18▲ 单日 +0 持续低位 · 累计跨日 60▲) - 🟡 评级决策窗口:7-28 ~ 7-30 累计复核 + 是否落定 P2 旁证评级升级 + 是否触发反向降级 - 结构性信号:「AREX 142▲ 持续登顶」+ 「⚠️ SDM 18▲ 持平低位持续 7-28 三日累计复核激活」 = v29 §2.114.2 续立 + v34 §3.3 反方 #55 评级升级时机风险持续激活

与活文档 v29 §2.114.2 + §3.2 争议 109 的关系: - v29 §2.114.2 已立 HF Daily 7-27 8 件 net-new + AREX 139 + SDM 跌出 7 反方硬标签 - v29 §3.2 争议 109 已立 14 件累计待人工确认 + SDM 跌出风险 - 本场 7-28 上午 AREX 142 +3 续立 + SDM 18▲ 持平低位 持续触发评级升级决策 - v30 §2.114.2 续立 + §3.2 争议 110 应新增 AREX 升档 + SDM 三日累计复核

建议归入节:knowledge/ai-industry.md §2.114.2 续立 + 新增 AREX 142▲ 单日 +3 续立子节 + §3.2 争议 110 新增 SDM 三日累计复核决策窗口 + §4.1 开放问题 208 新增

arXiv 号(本节沿用):arXiv:2607.21461(AREX)+ arXiv:2607.21576(SDM)


增量 7 · ⭐⭐⭐⭐ · HF 7-28 Cosmos-H-Dreams 外科手术机器人 + TLDR AI 7-27 Claude Opus 5 + OpenAI 黑客事件内幕 + NVIDIA 开源权重联署信(v29 已承 HF 7 月安全事件披露)

来源:stephen 2026-07-28-1005-news-hf-blog 第 1 条 NVIDIA Cosmos-H-Dreams: 将实时生成式仿真引入外科手术机器人 · stephen 2026-07-28-1005-news-tldr-ai 第 1 条 7-27 Claude Opus 5 + OpenAI 黑客事件内幕 + NVIDIA 开源权重联署信 · v29 §2.114.8 已承接 HF 7 月安全事件披露

要点: - 🟡 NVIDIA Cosmos-H-Dreams 外科手术机器人 —— NVIDIA Cosmos 实时生成式仿真 + 外科手术机器人 = 物理 AI 在医疗机器人落地 + NVIDIA Cosmos 路线扩展(承接 v29 §2.114.10 NVIDIA 大本营内部) - 🟡 TLDR AI 7-27 头条 3 件:① Claude Opus 5 7-24 evening 发布(沿用 v28)② OpenAI 黑客事件内幕(沿用 v29 HF 7 月安全事件 + OpenAI × HF 联合披露 = 7-25~7-27 三日双披露窗口延伸)③ NVIDIA 开源权重联署信(承接 v29 Jim Fan 转 Jensen Huang "GOAT" + ByteByteGo 增量 3 NVIDIA 开源模型) - 🟡 NVIDIA 开源权重联署信「open models matter」:NVIDIA 联署 + Jim Fan 转 Jensen Huang "GOAT" + ByteByteGo NVIDIA 开源模型 7-28 net-new = NVIDIA 大本营内部升档(承接 v29 §2.114.10 Jensen Huang NVIDIA 4 万亿 + vs LeCun AMI Labs 路线分歧) - 结构性信号:NVIDIA Cosmos 物理 AI 医疗机器人 + Claude Opus 5 + OpenAI 黑客事件内幕 + NVIDIA 开源权重联署信 + ByteByteGo NVIDIA 开源模型 = NVIDIA 大本营内部升档 + 评论层长尾第 3-4 例;承接 v29 §2.114.8 + §2.114.10 + §3.2 争议 108

与活文档 v29 §2.114.8 + §2.114.10 的关系: - v29 §2.114.8 已立 HF 7 月安全事件披露 + OpenAI × HF 联合披露 = frontier lab × AI 平台层 安全协作范式 第 1-2 例 - v29 §2.114.10 已立 Jensen Huang NVIDIA 4 万亿 + LeCun AMI Labs + Jim Fan NVIDIA 立场 3.0 - 本场 7-28 上午 NVIDIA Cosmos-H-Dreams + TLDR AI 7-27 三件头条 = NVIDIA 大本营内部升档 + 评论层长尾续立 - v30 §2.114.8 续立 + §2.114.10 新增 NVIDIA Cosmos 子节 + §3.2 争议 111 新增

建议归入节:knowledge/ai-industry.md §2.114.8 续接 + §2.114.10 续接 + 新增 NVIDIA Cosmos-H-Dreams 医疗机器人子节 + §3.1 共识新增第 131 条

arXiv(本节无新立)


值得警惕的矛盾或待核实说法

待核实 1 · AREX 142▲ 持续登顶 vs HF Daily 7-27 8 件 vs 7-28 5 件 net-new 缩量结构未明

  • HF Daily 7-27 8 件 net-new(AREX 139 + SLAI T-Rex + K12-KGraph + 视觉对比自蒸馏 + 超越相关性中心检索 + SANA-Video 2.0 +6 + NVIDIA-labs OO Agents + LLM 用户意图中迷失 + Tencent WorkBuddy Bench + 主动观察者的考核)
  • HF Daily 7-28 5 件 net-new(ReferTrack + DataPrep-Bench + Show Don't Tell + Skill Self-Play + Molt)
  • 待核实:7-28 5 件 net-new vs 7-27 8 件 net-new 是否持续缩量;5 件 net-new 立标级候选强度是否达到 v34 §2.39.x 主线升档标准;累计跨日票数增长曲线是否触顶

待核实 2 · Self-Supervised Structured Dynamics 18▲ 三日累计复核决策窗口

  • 7-26 单日 14→28▲ 翻倍最大升幅(v33 §2.39.91 P3 → P2 旁证评级升级决策触发)
  • 7-27 次日 28→18▲ 单日 -10 跌出前 15 名边缘
  • 7-28 三日 18→18▲ 单日 +0 持续低位
  • 待核实:SDM 三日累计 60▲ 是否触底回升;7-29 ~ 7-30 持续复核窗口;评级升级 P2 旁证 vs 反向降级决策

待核实 3 · Gradient Flow「AI 数据中心算式」算式细节

  • Gradient Flow 主张:投入资金累积速度远快于任何能证明它合理的经济依据;AI 系统使用量增长但 capex/opex 累积超过经济回报
  • 待核实:具体数据中心资本支出数据来源(CNBC / Bloomberg / The Information 等);vs v29 §2.113 Simon Willison token 中继市场 AI 经济基础设施新层关系(同 vs 异);vs v29 §3.1 共识 125「正规经济 vs 灰色经济」对照

待核实 4 · ByteByteGo NVIDIA「如何构建开源模型」 Bryan Catanzaro 完整披露

  • 7-28 net-new · Bryan Catanzaro 应用深度学习研究副总裁
  • 待核实:具体开源模型名称(Nemotron 系列?);架构设计考量 + 训练 pipeline 完整披露;vs v29 §2.114.10 Jensen Huang NVIDIA 4 万亿 + vs LeCun AMI Labs 路线分歧

待核实 5 · Nathan Benaich「欧洲无法通过租赁方式实现 AI 主权」具体论据

  • 7-28 net-new · Nathan Benaich 主张:华盛顿能在一夜之间禁用某个模型;问题已不再是 AI 是否安全,而是由谁掌控
  • 待核实:具体欧洲主权 AI 路径(Mistral / Aleph Alpha / Le Chat / OpenEuroLLM 等);vs 美国出口管制;vs v29 §3.3 国内主线焦点

待核实 6 · Import AI 466「OpenAI 意外的 AI 黑客」具体技术细节

  • 7-28 net-new · Import AI 466(Jack Clark)第 3 条
  • 待核实:OpenAI 黑客 vs v29 HF 7 月安全事件披露 + OpenAI × HF 联合披露关系(同 vs 异);具体技术漏洞类别

待核实 7 · Simon Willison 7-27 晚场 Kimi K3 1.56TB HuggingFace 上线 vs 7-26 evening 沿用关系

  • v29 已承 Kimi K3 沿用;本场 7-27 晚场 Simon Willison 追加发布 + 1.56TB 上线
  • 待核实:7-27 evening vs 7-28 morning 时间线一致;HF Daily 票数 vs Kimi K3 权重发布日期

待核实 8 · paper_cards 7-28 13 张新卡 ai-industry 主线关联性

  • 602-2607-16859(Dataset Distillation by Influence Matching / 主分类 engineering)
  • 603-2607.22043(Scaling Native Multimodal / 主分类 multimodal / Tencent Hunyuan) ✓ flyp dual critical read
  • 604-2607.22375(IDEAgent / 主分类 agent) - 待核实与 v29 §2.114 agent 主线关联
  • 605-2607.22042(LAMAR / 主分类 rag) ✓ tom rag-e1prep §1 立标
  • 606-2607-21848(Closing the Loop / 主分类 multimodal)
  • 607-2607.21653(Molt / 主分类 agent) ✓ HF Daily 7-28 24▲ 立标候选
  • 608-2607.14277(Multi-Head Latent Control / 主分类 agent) ✓ tom radar 7-28 0840 高价值 #2
  • 609-2607.12756(VisCo / 主分类 multimodal) - vLLM KVpop/LCA 邻接
  • 610-2607.22157(Learning on the Job / 主分类 agent) ✓ tom 20:40 雷达首选
  • 611-2607.22345(Teachy Mini / 主分类 evaluation) ✓ tom 20:40 雷达高价值 #2
  • 612-2607.22091(Spectral Prior / 主分类 multimodal)
  • 613-2607.19636(Multimodal Speaker Verification / 主分类 multimodal)
  • 614-2607.18198(Three-Body Scattering / 主分类 multimodal)
  • 待核实:613/614 是否入 v34 §2.39.x 立标候选;612 Spectral Prior 是否入 inference efficient 主线

可引用 arXiv 号列表

新增立标级候选 5 件(HF Daily 7-28 net-new)

  • arXiv:2607.20061(ReferTrack 先指代后跟踪的具身视觉跟踪)
  • arXiv:2607.20465(DataPrep-Bench LLM 作为训练数据准备者的基准)
  • arXiv:2607.21072(Show Don't Tell 在生成像素而非 LLM 文本中评估空间认知)
  • arXiv:2607.22529(Skill Self-Play 通过技能协同进化拓展 LLM 能力边界)
  • arXiv:2607.21653(Molt 面向 Agent RL 的可扩展 PyTorch 原生训练框架)

flyp dual critical read 新增 2 件(v34 §2.39.x 立标候选)

  • arXiv:2607.22043(Scaling Native Multimodal Pre-Training From Scratch / Tencent Hunyuan / 主分类 multimodal)
  • arXiv:2607.18142(O-VAD Industrial Video Anomaly Detection through Object-Centric Tracking and Reasoning / ECCV 2026 / 主分类 multimodal)

沿用 v29 HF Daily 续立(v29 §2.114.2 已立)

  • arXiv:2607.21461(AREX 142▲ 持续登顶)
  • arXiv:2607.21553(SANA-Video 2.0 34▲ 持续登顶)
  • arXiv:2607.20709(NVIDIA-labs OO Agents 28▲ 持续登顶)
  • arXiv:2607.20911(Tencent WorkBuddy Bench 24▲ 持续登顶)
  • arXiv:2607.21576(⚠️ Self-Supervised Structured Dynamics 18▲ 持续跌出前 15 名外)
  • arXiv:2607.16165(主动观察者的考核 25▲)
  • arXiv:2607.20734(LLM 在不断演化的用户意图中迷失 22▲)
  • arXiv:2607.12746(通过相机-显示器耦合实现颜色透传 19▲)
  • arXiv:2605.09635(K12-KGraph 57▲)

沿用 v29 已承接 115 件 arXiv(v29 §0 完整列表)

  • 全部 115 件保留(详 v29 §0 承接清单)+ 新增 7 件 = 122 件
  • 11 CVE 全部保留
  • 87 URL 全部保留(沿用 v29)

paper_cards 7-28 新增 13 张关联 arXiv

  • arXiv:2607.16859 / 2607.22043 / 2607.22375 / 2607.22042 / 2607.21848 / 2607.21653 / 2607.14277 / 2607.12756 / 2607.22157 / 2607.22345 / 2607.22091 / 2607.19636 / 2607.18198(13 件)

与 v29 活文档承接关系(总览)

承接 v29 4 主线密集 + 9 件 P0 + 1 件统一主线立标 + 14 件待人工确认 + 2 件紧急提醒

  • ✅ Anthropic Economic Index connector 7-27 morning 落地 + Economic Futures Research Fund 议程第二阶段 + Public First Action 再捐 2000 万美元(v29 §2.111)
  • ✅ AAAI 2026 Subramanian「Keyword search is all you need」arXiv:2602.23368v1 = 5 实例同步立标(v29 §2.112)
  • ✅ Simon Willison 7-26「token 转售中继市场 + 欺诈」= AI 经济基础设施新层(v29 §2.113)
  • ✅ 评论层 → 集中观察型落地 2-3 例(v29 §2.114.1)
  • ✅ HF Daily 7-27 8 件 net-new + jay engineering-v37 6 件 + inference/database P0 9 件 + jay 1620 CSDN 4 件 + flyp Cameron Wolfe 双稿 + flyp AgentRx v2 + HF 7 月安全 + tom 20:40 雷达 2 件 + Lex Fridman 7-27(v29 §2.114.2 ~ §2.114.10)

第 30 版 v30 新增(承接 + 新增)

  • 承接 v29 全部 + 新增 7 条主线增量
  • 第 30 版窗口 7-27 22:00 → 7-28 22:00 24h
  • 预计承接 151 主线 + 新增 7 条 = 158 主线(待 evening 棒收官确认)
  • 126 共识 / 109 争议 / 207 开放问题 = 130 / 111 / 208(待 evening 棒收官确认)
  • 122 arXiv 编号(承接 115 + 新增 7)
  • 11 CVE 全部保留
  • 87+ URL 全部入档(承接 + 新增待确认)

v30 建议归入节(7 条主线增量)

  • §2.114.1 续接 + §2.115 Gradient Flow 双新立标(AI 数据中心算式 + 开源多旋钮)
  • §2.114.2 续立 + 新增 5 件 net-new 立标级候选(ReferTrack + DataPrep-Bench + Show Don't Tell + Skill Self-Play + Molt)
  • §2.114.10 续接 + 新增 ByteByteGo NVIDIA 开源模型子节
  • §2.116 评论层三栖新立标(欧洲 AI 主权 + Import AI 466 + ByteByteGo NVIDIA)
  • §2.114.6 续接(flyp dual critical read 7-28)+ multimodal.md v34 §2.39.x 新增 4 件立标候选中 2 件
  • §2.114.1 续接 Kimi K3 1.56TB HuggingFace 上线子节 + Mollick 指南反应
  • §2.114.2 AREX 142▲ 单日 +3 续立子节 + §3.2 争议 110 SDM 三日累计复核决策窗口
  • §2.114.8 续接 + §2.114.10 续接 + 新增 NVIDIA Cosmos-H-Dreams 医疗机器人子节

v30 窗口后续需关注(7-28 12:00 ~ 7-28 22:00 接力棒)

  • 🟡 jay 7-28 evening engineering-filter(预计 14:00 + 19:00 双班)+ five-category-briefing 11.5KB(预计 21:00 第八次/日)
  • 🟡 tom 7-28 evening 14:40 + 20:40 radar 双班 + inference-e1prep + agent-rag-longcontext-radar
  • 🟡 flyp 7-28 evening multimodal/coding-agents/risk e1prep 接力棒 + Cameron Wolfe / Interconnects 续读
  • 🟡 spark 7-28 noon + evening agent/llm-infra/risk e1prep 接力棒
  • 🟡 stephen 7-28 noon + evening coordination check 双棒 + llm-application-e1prep 接力
  • 🔴 紧急:AAAI 2027 截稿 2026-07-28(今天)+ EU AI Act 2026-08-02 合规截止(5 个工作日后)
  • 🟡 HF Daily 7-28 后续班次(预计 14:00 + 22:00 更新);AREX 142▲ + SDM 18▲ 三日累计复核持续激活
  • 🟡 paper_cards 7-28 后续班次新卡 + multimodal v34 续接 + risk v 续接

无显著新增量时说明

本场 ai-industry 主题相对 v29 4 主线密集 + 9 件 P0/立标候选增量,新增量结构为「7 条主线增量 + 8 件待核实 + 13 张 paper_cards 新建卡 + 7-28 上午批次元数据 65+ 项」,核心增量池:

  1. Gradient Flow 7-28 双新立标(AI 数据中心算式 + 开源多旋钮)
  2. HF Daily 7-28 票榜 5 件 net-new 立标级候选(ReferTrack + DataPrep-Bench + Show Don't Tell + Skill Self-Play + Molt)
  3. 评论层三栖新立标(Nathan Benaich 欧洲 AI 主权 + Import AI 466 + ByteByteGo NVIDIA 开源模型)
  4. flyp 7-28 dual critical read(Scaling Native Multimodal + O-VAD = v34 §2.39.x 立标候选新增 2 件)
  5. Simon Willison 7-27 晚场 Kimi K3 1.56TB HuggingFace 上线 + Mollick 指南反应
  6. HF Daily 7-28 AREX 142▲ 持续登顶 + SDM 18▲ 三日累计复核决策窗口
  7. HF Cosmos-H-Dreams 外科手术机器人 + TLDR AI 7-27 三件头条 + NVIDIA 开源权重联署信

无显著「统一主线立标」候选(本场为「评论层 → 集中观察型落地」第 4-5 例 续接 + HF Daily 票榜续立/翻倍 + paper_cards 新建卡 续接);v30 evening 棒收官应聚焦 7 条主线增量承接 + 8 件待核实截止 + HF Daily 后续班次续立 + paper_cards 7-28 后续班次新建卡


Stephen · E1 第 30 次预消化 · 2026-07-28 10:20 Asia/Shanghai(CST) 本文件为 ai-industry E1 预消化简报,7 条主线增量 + 8 件待核实 + 13 张 paper_cards 新建卡 + 65+ 项元数据全核