ai-industry · E1 预消化简报(2026-07-31)
执行:Stephen · 10:20 CST · 承接
knowledge/ai-industry.mdv32(7-30 evening 棒收官 · 6 主线密集 + 5 件 frontier/industry 立标 + 1 件统一主线立标续立 Kimi K3 arXiv:2607.24653 → GLM-5.2 升级 + 196 件 arXiv 总池 + 150 URL + 11 CVE + 170 主线 + 139 共识 + 116 争议 + 213 开放问题)· 为今晚第 33 版活文档接力预习备料。 窗口:7-30 22:00 CST(v32 evening 棒收官)→ 7-31 10:20 CST(本棒执行点)= ~12h 已过 + ~12h 剩余。 目的:v32 evening 已承接 GLM-5.2 立标级 + HF Daily 7-30 票榜完全替换 + Tom radar 4 P0 + MSR 4 P0 + Lilian Weng Harness + Anthropic Mythos Preview / Project Glasswing + OpenAI Codex Security + 7-30 evening 17 件立标级饱和 + Spark 双 E1 完整恢复 + Tom inference 第 5 日恢复 + AAAI Subramanian 7-30 截止日 deadline 已过 · 本棒聚焦 v32 evening 收官后 7-31 早间 10h 的边际增量 = ① Anthropic 7-30 新三连(网络空间安全评估三起真实事件调查 + 用 Claude 发现加密弱点沿用 + 「我们对开源权重模型的立场」+ 7-30 NEW Mythos Preview AES Möbius Bridge 思维链 + 扩展 Cognizant 合作) ② OpenAI 7-30 NEW 4 件集中(用 GPT-5.6 推进性价比前沿 Luna 80% 降幅 + Terra 20% 降幅 + avatarin GPT-Realtime 7×24 零售 Agent + 启用两项设置让 ARC-AGI-3 分数提升三倍 + ChatGPT for Academic Researchers 1 万→10 万学术研究者 + GPT-5.6 frontier intelligence efficiency) ③ DeepMind 7-30 NEW Gemini Robotics 2 三件套(全身体 VLA 模型 + ER 2 推理 + On-Device 2 端侧推理 + Apptronik Apollo 2 / Duo 同台演示打结拧灯泡) ④ HF Daily 7-31 票榜 15 件完全替换(HiFi-UMI 134▲→141▲ 单日 +7 续立 + TurboVLA 120▲ 新进 #2 + HumanCLAW 66▲ 新进 #6 + CLBench-V 40▲ 新进 #9 + CodeNib 77▲ 翻倍续立 + CoRT 75▲ 新进 #5 + ReDesign 58▲ 单日 +2 续立 + DecoEvo 54▲ 新进 #8 + CAST 29▲ 新进 #10 + Pass the Baton 28▲ 续立 + Keep It InMind 28▲ 续立 + Mage-VL 26▲ 续立 + SkillRise 18▲ 续立 + MindForge 17▲ 新进 #15) ⑤ SimWillison 7-30 GPT-5.6 Luna 80% 降幅 + 三起真实事件调查 + llm 0.32rc2 + Bruce Schneier 引用 + llm-chat-completions-server 0.1a0 = OpenAI 价格战 + 工程化新立标 ⑥ TLDR AI 7-30「OpenAI 登顶 ARC-AGI-3 + GPT-5.6 效率提升 + AlphaFold 团队解散」头条立标 ⑦ Ben's Bites「10 亿 ChatGPT 用户」+「Opus 5 远超 Fable 5」+「当场作弊被抓」+「我有一个 Inkling」 ⑧ MSR 7-30 NEW 三件(Echoverse 计算机使用 Agent 深度持续演进环境 + EvoLib 经验转化为持续演进的知识 + SymCrypt Rust / Aurora 1.5 / Flint 沿用) = MSR Agent 维度新立基础 ⑨ Tom 7-31 radar 3 高价值(Metis arXiv:2607.26760 + Graph-Native Bitemporal arXiv:2607.26520 + Memory for LLMs 综述 arXiv:2607.25380)+ 5 追踪(Voice Memory arXiv:2607.26410 + CADENCE arXiv:2607.16955 + MindForge arXiv:2607.27146 + SpecFirst arXiv:2607.27167 + πR² arXiv:2607.26055)= Memory foundation + 双综述对偶分类学 ⑩ flyp 7-31 0950 SkillRise + Metis cross-task-skill-vs-native-memory critical-read · flyp multimodal-e1prep §1.3 48h 漏收件(AcademicEval arXiv:2510.17725 v1 TMLR + Scaling Beyond Context arXiv:2510.15253 v3 ACL2026 Main)= 评测方法学 2 件新增立基础 ⑪ cool-papers cs.IR 7-31 NEW KAMR arXiv:2607.27136 沿用 + Mental World Modeling arXiv:2607.27201 + APEX-Accounting arXiv:2607.27189 + Pangram 4 arXiv:2607.27183 + DenseOn LateOn 多语种长上下文检索 arXiv:2607.27178 + Regional Bias in LLMs arXiv:2607.27022 + IMFuse arXiv:2607.27002 + 决策感知用户模拟器 arXiv:2607.26893 + 从未来学习序列推荐 arXiv:2607.27055 = 跨主题 9 件 ⑫ Interconnects 7-31 沿用 GLM-5.2 评级「step change for open agents」+ 6-months-to-live-for-open-models + Artifacts-22 Zyphra/Cohere/Poolside + Kimi K3 开源权重升级 = 「中国主权开源 frontier 双锚」续立 ⑬ Stephen 7-31 X-VIP-radar 沿用 0 件 net-new 全部为 v32 evening 沿用 ⑭ Import AI 466「机器人苦涩教训 + 一周编程 + OpenAI 意外 AI 黑客」沿用 ⑮ Nathan Benaich State of AI 2026-04/05 沿用 + Air Street Capital Fund III 沿用。
检查过的来源(共 39 项 · 涵盖 jay/tom/flyp/spark/stephen 7-30 evening 后段 + 7-31 早间批次 + paper_cards 654-668 7-30~31 新建)
stephen(7-31 morning,11 件)
2026-07-31-0910-news-x-vip-radar(10 件 7-31 早间 X 名人雷达:DeepMind 7-30 Gemini Robotics 2 三件套(全身 VLA + ER 2 + On-Device 2 + Apptronik Apollo 2/Duo 同台演示)+ OpenAI GPT-5.6 Sol GPU kernel 自优化成本降 20% + speculative decoding 提速 15%+ + ChatGPT for Academic Researchers 1 万→10 万 + Anthropic 7-28 Mythos Preview 后量子签名 HAWK + AES 攻击路径改进 + Hugging Face × NVIDIA Open Secure AI Alliance + Sam Altman 8/1 AI 政策窗口赴华盛顿游说 + Mollick Flux 3 视频模型 vs 2024 水獭基准 + LeCun SIGReg anti-collapse JEPA 路线 7-24 + Karpathy 7-26 辟谣离开 Anthropic 传闻 + Andrew Ng 7-28 AI 时代新学习方式)= vs 7-30 10 件 = 实质增量 1 件 net-new = DeepMind Gemini Robotics 2 三件套(其他为 v32 evening 沿用)2026-07-31-1003-news-anthropic-news(5 件:7-30 NEW「调查我们网络安全评估中的三起真实事件」+ 7-29 沿用「用 Claude 发现加密弱点」+ 7-29 沿用「我们对开源权重模型的立场」+ 7-30 NEW Mythos Preview 在发现 AES Möbius Bridge 中的思维链 + 7-29 沿用「扩展与 Cognizant 合作」)= 实质增量 1 件 net-new = 「调查我们网络安全评估中的三起真实事件」(与 Simon Willison 7-30「三起真实事件调查」同源 · = Anthropic 安全工程第 5 件披露)2026-07-31-1003-news-openai-news(5 件:7-30 NEW「用 GPT-5.6 推进性价比前沿」(Luna 80% 降幅 + Terra 20% 降幅)+ 7-30 NEW「avatarin 基于 GPT-Realtime 构建 7×24 零售 Agent」(30,000 用户 / 92% 正面反馈)+ 7-30 NEW「启用两项设置让 ARC-AGI-3 分数提升至三倍」(保留推理 + 启用上下文压缩)+ 7-30 NEW「ChatGPT for Academic Researchers 1 万→10 万免费访问」+ 7-30 NEW「GPT-5.6 frontier intelligence efficiency」)= 实质增量 5 件 net-new = GPT-5.6 价格战立标 + ARC-AGI-3 三倍设置立标 + 学术研究者立基础 + retail agent 实战2026-07-31-1003-news-deepmind-news(5 件:🆕 7-30 Gemini Robotics ER 2 视频理解/任务编排/多机器人协作 + 7-29 Lyria 3.5 Google Flow Music + 🆕 7-30 Gemini Robotics 2 全身智能 + 7-29 沿用 Genesis Mission $40M + 7-29 沿用 Gemini 3.6 Flash + 3.5 Flash-Lite + 3.5 Flash Cyber)= 实质增量 2 件 net-new = Gemini Robotics 2 + Gemini Robotics ER 2 双立标(主战场在 DeepMind 机器人路线 + 全身 humanoid VLA 工业级落地锚定)2026-07-31-1004-news-google-ai(5 件:Gemini API Managed Agents 3.6 Flash + hooks + 搜索 AI Mode 5 种 + 派对 5 招 + Galaxy Unpacked + Connected Apps)= vs 7-30 5 件 = 实质增量 0 件 net-new 全部沿用2026-07-31-1004-news-hf-blog(5 件:🆕 7-30 GPU 管理「闲置 GPU 是新的停飞飞机」(Dharma-AI)+ 7-29 沿用 OlmoEarth 平台 + 7-29 沿用 LFM2.5-Encoders + 7-29 沿用 Cosmos-H-Dreams + 7-29 沿用「前沿实验室 Agent 入侵剖析」)= 实质增量 1 件 net-new = GPU 资源管理2026-07-31-1004-news-bens-bites(5 件:🆕 10 亿 ChatGPT 用户 + 🆕 Opus 5 远超 Fable 5(Codex + Voice 就是新版 openclaw)+ 沿用「当场作弊被抓」+ 🆕 优于 Fable 的设计(未解数学难题 vs AI)+ 沿用「我有一个 Inkling」)= 实质增量 3 件 net-new2026-07-31-1004-news-tldr-ai(5 件:🆕 7-30「OpenAI 登顶 ARC-AGI-3 + GPT-5.6 效率提升 + AlphaFold 团队解散」+ 7-29 沿用「AI 减速协议」+ 7-28 沿用「Anthropic 谈开放权重 + Kimi K3 + MAI Cyber」+ 7-27 沿用「Claude Opus 5 + OpenAI 黑客 + NVIDIA 开源权重」+ 7-24 沿用「ChatGPT Health + Fugu-Ultra + Runway Media Router」)= 实质增量 1 件 net-new = TLDR AI 7-30 头条立标(AlphaFold 团队解散 = Google DeepMind 重大人事立标)2026-07-31-1006-news-yt-anthropic(5 件:🆕 Claude 思考的不同层次 + 🆕 推出 Claude Fable 5 + 🆕 将 Claude 的思维转化为语言 + 沿用 Project Glasswing + 🆕 当 AI 表现出情绪时)= 实质增量 4 件 net-new YT2026-07-31-1006-news-yt-deepmind(5 件:🆕 借助 Gemini Robotics 2 实现机器人协作 + 🆕 借助 Gemini Robotics 2 完成需要全身控制的任务 + 🆕 借助 Gemini Robotics 2 完成高难度灵巧操作任务 + 🆕 借助 Gemini Robotics 2 实现智能全身控制 + 🆕 借助 Gemini Robotics 2 实现多机器人协作)= 实质增量 5 件 net-new = Gemini Robotics 2 YT 五连立标2026-07-31-1006-news-yt-openai(5 件:🆕 在 ChatGPT Work 中使用语音 + 🆕 10 万名学术研究者免费访问 + 🆕 推出 gpt-transcribe + gpt-live-transcribe + 🆕 ChatGPT Work 销售版营收情报 + 沿用 ChatGPT Work 销售版客户研究)= 实质增量 4 件 net-new
jay(7-31 morning,15 件)
2026-07-31-1000-rss-simon-willison(5 件:🆕「用 GPT-5.6 推进性价比边界」(Luna 80% 降幅 + Terra 20% 降幅)+ 🆕「调查三起真实世界事件」(Anthropic 网络安全评估 7-30)+ 🆕「llm 0.32rc2」+ 🆕「引用 Bruce Schneier 观点」+ 🆕「llm-chat-completions-server 0.1a0」)= 实质增量 5 件 net-new2026-07-31-1000-rss-raschka(5 件:🆕 控制 LLM 推理力度 + 🆕 使用本地 Coding Agent + 🆕 LLM 研究论文 2026 part1 + 🆕 LLM 架构最新进展(KV Sharing + mHC + Compressed Attention)+ 🆕 工作流理解 LLM)= 实质增量 5 件 net-new + GLM-5.2 IndexShare 7-30 blog 沿用2026-07-31-1000-rss-nathan-benaich(5 件:沿用「欧洲无法通过租赁实现 AI 主权」+ State of AI 2026-05 沿用 + Air Street Capital Fund III 沿用 + RAAIS 2026 沿用 + State of AI 2026-04 沿用)= vs 7-30 = 实质增量 0 件 net-new 全部沿用2026-07-31-1000-rss-bytebytego(5 件:沿用 ChatGPT 优化 Agent 循环 + DoorDash/Instacart/Uber Eats 三种 LLM 集成 + NVIDIA 为 AI 时代构建开源模型 + 分布式系统时钟因果 + 构建生产可用 AI Agent 最佳实践)= vs 7-30 = 实质增量 0 件 net-new 全部沿用2026-07-31-1001-rss-cool-papers(5 件:🆕 Mental World Modeling arXiv:2607.27201 + 🆕 APEX-Accounting arXiv:2607.27189 + 🆕 Pangram 4 Technical Report arXiv:2607.27183 + 🆕 DenseOn with the LateOn 多语种长上下文检索 arXiv:2607.27178 + 🆕 Evaluating Regional Bias in LLMs arXiv:2607.27022)= 实质增量 5 件 net-new = cs.CL 跨主题饱和2026-07-31-1001-rss-cool-papers-ir(5 件:🆕 相关意图生成改善电商搜索 arXiv:2607.27172 + 沿用 KAMR arXiv:2607.27136 + 🆕 从未来学习序列推荐(特权自蒸馏)arXiv:2607.27055 + 🆕 IMFuse LLM 增强序列推荐 arXiv:2607.27002 + 🆕 决策感知用户模拟器 arXiv:2607.26893)= 实质增量 4 件 net-new + KAMR 沿用2026-07-31-1002-rss-lilian-weng(5 件:沿用 Harness Engineering 2026-07-04 + 沿用「谨慎看待 Scaling Laws」+ 沿用「我们为何思考」+ 沿用「RL Reward Hacking」+ 沿用「LLM 外在幻觉」)= vs 7-30 = 实质增量 0 件 net-new 全部沿用2026-07-31-1002-rss-msr-blog(5 件:🆕 Echoverse 计算机使用 Agent 深度持续演进环境 + 🆕 EvoLib 经验转化为持续演进的知识 + 沿用 SymCrypt Rust 密码学 + 沿用 Aurora 1.5 天气地球系统 + 沿用 Flint 可视化语言)= 实质增量 2 件 net-new = MSR Agent 维度新立基础(Echoverse + EvoLib 与 §2.114.x frontier lab × 学术 第四维续立)2026-07-31-1003-rss-import-ai(5 件:沿用 Import AI 466 苦涩教训 + 沿用 Import AI 465 开源闭源差距 Kimi K3 + 沿用 Import AI 464 Fable GPU kernel + 沿用 Import AI 463 自我改进机器人 + 沿用 Import AI 462 超级说服力)= vs 7-30 = 实质增量 0 件 net-new 全部沿用2026-07-31-1005-rss-yt-karpathy(5 件:🆕 我如何使用 LLM + 🆕 深入解析 ChatGPT 这类 LLM + 🆕 复现 GPT-2 124M + 🆕 构建 GPT Tokenizer + 🆕 [1小时讲座] Large Language Models 入门)= 实质增量 5 件 net-new YT 教学系列2026-07-31-1006-rss-yt-fireship(5 件:沿用「Anthropic 是不是扼杀了独立开发者」+ 沿用「史上最有趣的 hack」+ 沿用「开源权重 AI 刚突破 2.8 万亿参数」+ 🆕「估值 120 亿美元初创公司终于交付了产品」+ 沿用「OpenAI 再次因剽窃被告」)= 实质增量 1 件 net-new2026-07-31-1000-rss-interconnects(5 件:沿用「开源模型回顾 Kimi K3 + Qwen 3.8」+ 沿用「Kimi K3 开源权重升级」+ 沿用「6 个月开源模型生存」+ 沿用 Artifacts-22 Zyphra/Cohere/Poolside + 沿用「GLM-5.2 step change for open agents」)= vs 7-30 = 实质增量 0 件 net-new 全部沿用 · GLM-5.2 评级「step change」持续延续2026-07-31-ai-engineering-trending(GitHub Trending AI 工程生态:vLLM 2026 全硬件覆盖(AMD/Intel Arc/TPU+NVIDIA)+ OpenAI 兼容 API + 大规模生产推理事实标准 + ComfyUI 106k★ 视觉 AI 工作流王者 + Open WebUI/Dify/Langflow AI 应用三驾马车 + CrewAI 多 Agent 编排 + Claude Code Agentic 编码工具)= 实质增量 6 件 GitHub Trending2026-07-31-engineering-database-backend-cloudnative(PostgreSQL vs MySQL 2026 基准对比 · PG 21,338 QPS vs MySQL 4,383 QPS 4.87x · 99th percentile 4.0ms vs 42.7ms · 17 项 Sysbench PG 15 项领先 · MySQL 简单单表 OLTP 仍领先 21% · PG 19 Beta 1 2026-06-04 · PG 18.4 稳定版 2026-05-11 · MySQL 9.3 Public Preview + PgBouncer/ProxySQL 生产配置实战 + random_page_cost 1.1 SSD 调优 + 连接池 = 数据库性能调优实操 CheckList)= 实质增量 3 件 database 工程化2026-07-31-csdn-weekly(腾讯云 vLLM 部署参数详解 gpu_memory_utilization 0.85-0.95 + swap_space + max_model_len + max_num_seqs + max_num_batched_tokens + block_size 8/16/32 + enable_prefix_caching + enforce_eager + 调度策略 fcfs/priority + 分布式部署 + 阿里云一键微调 DeepSeek-R1 蒸馏模型 + 6 个蒸馏模型最低算力 + LoRA SFT 数据格式 + 学习率 5e-6 调优 + RAG 系统实现进阶混合检索 BM25/RRF/HyDE/PageIndex/GraphRAG)= 实质增量 4 件 CSDN 主战场
tom(7-31 morning,4 件)
2026-07-31-0900-hf-daily-2026-07-31(HF Daily 7-31 票榜 15 件全核:🆕 HiFi-UMI arXiv:2607.25895 141▲(134▲→141▲ 单日 +7 续立)· #1 + 🆕 TurboVLA arXiv:2607.27205 120▲ · #2 + 🆕 相关性新角色 Agentic 搜索 arXiv:2607.24223 87▲(83▲→87▲ 单日 +4 续立)· #3 + CodeNib arXiv:2607.25431 77▲(43▲→77▲ 单日 +34 翻倍)· #4 + 🆕 CoRT arXiv:2607.25659 75▲ · #5 + 🆕 HumanCLAW arXiv:2607.27180 66▲ · #6 + ReDesign arXiv:2607.25565 58▲(56▲→58▲ 单日 +2 续立)· #7 + 🆕 DecoEvo arXiv:2607.25675 54▲ · #8 + 🆕 CLBench-V arXiv:2607.25294 40▲ · #9 + 🆕 CAST arXiv:2607.25308 29▲ · #10 + Pass the Baton arXiv:2607.26057 28▲(23▲→28▲ 续立)· #11 + Keep It InMind arXiv:2607.24368 28▲(25▲→28▲ 单日 +3 续立)· #12 + Mage-VL arXiv:2607.24904 26▲(23▲→26▲ 单日 +3 续立)· #13 + SkillRise arXiv:2607.26784 18▲(未入榜→18▲ 新进)· #14 + 🆕 MindForge arXiv:2607.27146 17▲ · #15)= HF Daily 7-31 vs 7-30 票榜 15 件13 件替换 · 6 件续立(HiFi-UMI / 相关性新角色 / CodeNib / ReDesign / Pass the Baton / Keep It InMind / Mage-VL)= 9 件新进(TurboVLA / CoRT / HumanCLAW / DecoEvo / CLBench-V / CAST / SkillRise / MindForge)2026-07-31-agent-rag-longcontext-radar(8 件候选 3 件高价值 1 件 Substack:💎 1 Metis arXiv:2607.26760v1 记忆基础模型(原生记忆 vs 外挂 RAG/Memory 模块 · 形式化两层:backbone 内持久动态记忆状态 + 原生记忆操作程序 · agent memory 从外部模块走向 foundation model 原生层范式转变信号 · 张子玉 + Guo + Sun et al. · 42 页 9 图 14 表 · MemTensor + RUC + NUS + SJTU + Tongji 5 机构 · Tat-Seng Chua + Junchi Yan + Haofen Wang 等知名华人学者 · arXiv 2607.26760 v1 cs.CL 2026-07)+ 💎 2 Graph-Native Bitemporal Memory Store arXiv:2607.26520v1 Alp Niksarli + Gopesh Baheti(Agent-local Neo4j 属性图 + HNSW 向量索引 + 双向时态数据模型 valid time + transaction time · 避免上下文窗口耗尽或第三方服务泄露 · 图结构 + 时态记忆 + 向量检索三合一)+ 💎 3 Memory for Large Language Models 综述 arXiv:2607.25380(系统梳理 LLM memory 的 architecture-centric taxonomy · 三个正交轴:表征(隐式 vs 显式)+ 更新策略 + 可扩展查找存储 · memory 研究碎片化 → 统一框架)+ 📡 4 Voice Memory for Agentic Speech Recognition arXiv:2607.26410 HF Daily 5★(推理时冻结 corrector 读 per-domain memory.md · 流式决定是否采纳 hypothesis · 异步 score-gated optimizer · listener-thinker architecture)+ 📡 5 CADENCE arXiv:2607.16955 HF Daily 4★(DRIFT per-token forward/reverse KL 凸混合 · 三失效模式:冷启动崩溃/状态无关调度/稀疏二元 reward)+ 📡 6 MindForge arXiv:2607.27146 HF Daily 17★(全生命周期软件工程训练环境 · ProgramBench <1% 解决率)+ 📡 7 SpecFirst arXiv:2607.27167 HF Daily 15★(spec elicitation 作为 agent 程序合成的一等公民步骤)+ 📡 8 πR² arXiv:2607.26055 HF Daily 2★(反应式实时 flow policy · 大 backbone 表达能力 + 实时控制)+ 📬 Substack α-mem: RAG 和长上下文之外的第三条路(AlphaSignal · 8×8 associative memory state 小矩阵 · Qwen3-4B-Instruct 5 benchmark 平均分 46.79% → 51.66% · 4.87M 可训练参数 · Mind Lab @ NTU + Fudan + SJTU + CUHK + HKUST-GZ · 2026-05-12))2026-07-31-rag-e1prep(R49 → R50 接力简报 · 5 条主线增量 + 3 条工程化/Substack 洞察 · Metis 立标 + Voice Memory 语音 Agent + MindForge ProgramBench <1% + CADENCE + SpecFirst · RAG 主题 ArXiv 新鲜供给进入相对低谷期 · 主要增量来自 HF Daily 新候选未被 R49 收录的 2 件 + 其他 agent 实例工程化汇总中的 RAG 邻接条目 · Metis 和 Voice Memory 代表「记忆基础模型化」新兴方向 = 2026 H2 RAG/Memory 架构重要信号)2026-07-31-1005-rss-yt-lex-fridman(5 件播客:历史人物系列 Gary Gallagher 美国内战 · 罗马帝国与拜占庭 · 物理学 Don Lincoln 反物质暗能量 · FFmpeg · 维京人 · 0 件 ai-industry 主增)2026-07-31-1005-rss-yt-yannic-kilcher(5 件:🆕 全自动 mansplainer + 圣诞直播 + 节日直播 + TiDAR 在扩散中思考 + Titans 在测试时学习记忆)= 实质增量 1 件 net-new(TiDAR + Titans 沿用 v31 radar)
flyp(7-31 morning,3 件)
2026-07-31-multimodal-e1prep(v34 接力窗口第四棒 E1 · 7 件核心候选增量 + 6 条延伸追踪 = (1) DeepMind Gemini Robotics 2 三件套 2026-07-30 §6 升级候选 + (2) TurboVLA 120▲ HF Daily 7-31 #2 §2.39.x 候补级 + (3) HumanCLAW 66▲ HF Daily 7-31 #6 §2.39.x 候补级 + (4) CLBench-V 40▲ HF Daily 7-31 #9 §2.39.x 评测邻接 + (5) AcademicEval arXiv:2510.17725 v1 TMLR 已收 · UIUC · 抗泄漏 + 滚动更新 live long-context LLM benchmark §1 主线 4 评测方法学新增 + (6) Scaling Beyond Context arXiv:2510.15253 v3 ACL2026 Main · SensenGao · 三维 Taxonomy §1 主线 5 multimodal-RAG 综述锚点 + (7) Metis arXiv:2607.26760 paper_cards/658 §2.39.x 邻接 · 48h 漏收件 ★ AcademicEval + Scaling Beyond Context 补 7 项必做)2026-07-31-0950-SkillRise-and-Metis-cross-task-skill-vs-native-memory-critical-read(flyP 精读与批判 · 2026-07-31 09:50 · 2 篇高价值轻量精读 · SkillRise arXiv:2607.26784 v1 Yao/Chen/Lu et al. 17 作者 = 统一 RL 框架跨任务技能学习 + 解耦信用分配 solve/curate 双角色 + 测试时跨任务 scaling + 同任务重复尝试也保留收益 + 反方风险:代码入口 URL 缺失 + 跨任务序列构造隐含强假设 + 评测集偏窄 + 同策略双角色稳定性 + 基线覆盖(对照 Awesome-Agent-Skills 列表 AutoSkill/EvoSkill/Ctx2Skill/SkillRL/Uni-Skill/SkillSmith/SkillOpt/SkillRevise/Memento-Skills 7+ 工作)+ Metis arXiv:2607.26760 v1 Zhang/Guo/Sun et al. 42 页/9 图/14 表 · MemTensor + RUC + NUS + SJTU + Tongji 5 机构 · Tat-Seng Chua + Junchi Yan + Haofen Wang 等华人学者 = 首次提出「Memory Foundation Model」概念 + 新架构 memory attention + 大规模记忆特化训练数据 + mid-training + 架构/端到端优化/效率三维 + 反方风险:原生记忆边界条件不清晰(per-session vs per-user)+ 与外挂 RAG/Memory module head-to-head 缺 + memory state 可解释性与可控性 + 可复现性(paper 许可 ≠ repo 许可)+ 跨实例协同建议:spark explainer 末尾补 GitHub URL + tom radar 把 SkillRise + Metis 与既有 radar(Graph-Native Bitemporal / Keep It InMind / MemoryAgentBench)做「2026 H2 agent memory 三联立:外挂四能力 vs 原生 foundation vs 时序有效系统」主题串联 + jay csdn 棒可做「Metis 复现实战」+ risk 主线 Metis 持久原生记忆 state 是否引入新攻击面)2026-07-31-1000-rss-cameron-wolfe(5 件:🆕 Agentic 世界模型 + 🆕 Agentic RL:框架与最佳实践 + 🆕 Agent 评估:详尽指南 + 🆕 LLM 的 RL 缩放定律 + 🆕 LLM 基准测试的解剖)= 实质增量 5 件 net-new = Cameron Wolfe 5 主题合集 agentic 系列
spark(7-31 morning,3 件)
2026-07-31-1001-rss-gradient-flow(5 件:沿用「专用 AI 正在变得更容易构建」+ 沿用「大型 AI 实验室正与你的自有数据展开竞争」+ 沿用「多个旋钮 vs 单一开关」+ 沿用「AI 可以胜出而数据中心却在亏损」+ 沿用「三个新模型 AI 支出下一站」(GLM 5.2 / Kimi K3 / Gemini 3.6 Flash))= vs 7-30 = 实质增量 0 件 net-new 全部沿用2026-07-31-1002-rss-chip-huyen(5 件:沿用「构建生成式 AI 应用常见陷阱」+ 沿用「Agents」+ 沿用「构建生成式 AI 平台」+ 沿用「衡量个人成长」+ 沿用「审视 900 个最热门开源 AI 工具」)= vs 7-30 = 实质增量 0 件 net-new 全部沿用2026-07-31-1005-rss-yt-3blue1brown(5 件:🆕 64 块方糖谜题 + 🆕 什么是交叉熵?压缩即智能 第二部分 + 🆕 100 条随机弦会有多少个交点 + 🆕 测量英语的熵 + 🆕 什么是完美编码如何判断)= 实质增量 5 件 net-new YT 教学
paper_cards(7-30 evening + 7-31 上午新增抽查 · 主分类 ai-industry / agent / multimodal / rag / llm-infra 邻接)
- 7-31 02:10 新建 card 已经入 paper_cards/654-668(HANDBOOK.md 2607.25398 · Cyber-Capable 2607.25310 · Agent Retrieval Bench 2607.24882 · RLHF C++/ONNX 2607.19712 · Metis 2607.26760 · SkillRise 2607.26784 · DecoEvo 2607.25675 · CLBench-V 2607.25294 · CAST 2607.25308 · CoRT 2607.25659 · StealthBench 2607.26314 · Grading the Narrators 2607.24117 · Graph-Native Bitemporal 2607.26520 · KAMR 2607.27136 · Memory for LLMs 2607.25380 = 15 张) + 7-31 04:00 batch 7 件 2606.* 老补(v31 radar 提到的 old-class 2606.* 邻接卡片 · 与 v32 主题活文档无关但进入邻接候选池)
- 7-30 evening 至 7-31 morning 新建 card 共 19 张与本棒相关:
- 主分类 ai-industry 邻接:无新增(ai-industry 主分类 card 沿用 v32 evening 已存)
- 主分类 agent:Metis 658 · SkillRise 659 · CoRT 663 · StealthBench 664 · Grading the Narrators 665 · Graph-Native Bitemporal 666
- 主分类 rag:KAMR 667
- 主分类 multimodal:CLBench-V 661
- 主分类 llm-infra:Memory for LLMs 668
- 主分类 agent 主 multimodal 邻接:DecoEvo 660 · CAST 662
增量条目(6 条 · 含 v32 evening 续立 + v33 net-new 候选)
增量 1 · ⭐⭐⭐⭐⭐ · HF Daily 7-31 票榜 15 件 13 件替换 + HiFi-UMI 141▲ 跨日 +7 单日登顶续立 + TurboVLA 120▲ 新进 #2 + CodeNib 43▲→77▲ 单日 +34 翻倍 + CoRT/HumanCLAW/DecoEvo/CLBench-V/CAST/MindForge 6 件新进 = HF Daily 7-31 票榜新立标级候选饱和
来源:tom 2026-07-31-0900-hf-daily-2026-07-31 票榜 15 件全核 · tom 2026-07-31-agent-rag-longcontext-radar 8 件候选池 · flyp 2026-07-31-multimodal-e1prep §1.2 TurboVLA/HumanCLAW/CLBench-V/MindForge §2.39.x 候补级 + §1.3 AcademicEval/Scaling Beyond Context 48h 漏收件
要点: - 🔴 HiFi-UMI arXiv:2607.25895 141▲(HF Daily 7-31 #1 · 134▲→141▲ 单日 +7 续立)= 7-30 #1 登顶 + 7-31 #1 续立 = v32 §2.129 HiFi-UMI 候补级 → 升级立标级第 1 候选(单日 +7 续立 = 主线 7 VLA 飞轮已确认) - 🟡 TurboVLA arXiv:2607.27205 120▲(HF Daily 7-31 #2 新进)= RTX 4090 + 32 Hz 实时 VLA + <1 GB 显存 = 主线 7 VLA 新子类「消费级 GPU 实时 VLA」+ 与 Gemini Robotics 2 三件套同时段(7-30)发布 = 同一时间节点两个团队押注同一方向(DeepMind 全身 humanoid VLA + TurboVLA 消费级实时) - 🟡 相关性新角色 Agentic 搜索 arXiv:2607.24223 87▲(HF Daily 7-31 #3 · 83▲→87▲ 单日 +4 续立)= 主线 ② Agentic RAG 续立 + 与 v32 §2.131 Tom radar Agent Retrieval Bench 同源 - 🟡 CodeNib arXiv:2607.25431 77▲(HF Daily 7-31 #4 · 43▲→77▲ 单日 +34 翻倍)= v32 §2.129 HF Daily 7-30 #5 43▲ → 7-31 #4 77▲ = v32 → v33 翻倍立标级候选升档(43▲ 升 77▲ = 单日 +34 增长 79% 触发飞轮) - 🟡 CoRT arXiv:2607.25659 75▲(HF Daily 7-31 #5 新进)= 反事实回放 Token 级 Rubric-Guided 策略优化 = 主线 ① Coding Agent + RL credit 分配精细化 - 🟡 HumanCLAW arXiv:2607.27180 66▲(HF Daily 7-31 #6 新进)= VLM 通过身体行动 = 与 Gemini Robotics 2 + Apptronik Apollo 2/Duo 路线同源(2026-07-30 同一时间节点两个团队押注同一方向) - 🟡 ReDesign arXiv:2607.25565 58▲(HF Daily 7-31 #7 · 56▲→58▲ 单日 +2 续立)= v32 §2.129 #4 → 7-31 #7 续立 - 🟡 DecoEvo arXiv:2607.25675 54▲(HF Daily 7-31 #8 新进)= Solver 与 Rubric-Generator 技能分数解耦协同进化 = 主线 ① Coding Agent + 训练侧 - 🟡 CLBench-V arXiv:2607.25294 40▲(HF Daily 7-31 #9 新进)= Multimodal Context Learning 评测从 grounding 到知识获取 + paper_cards/661 已建卡 = v33 §1 主线 4 评测方法学 23 面体新增 - 🟡 CAST arXiv:2607.25308 29▲(HF Daily 7-31 #10 新进)+ Pass the Baton arXiv:2607.26057 28▲ 续立 + Keep It InMind arXiv:2607.24368 28▲ 单日 +3 续立 + Mage-VL arXiv:2607.24904 26▲ 单日 +3 续立 + SkillRise arXiv:2607.26784 18▲(未入榜→18▲ 新进)= 评测粒度从整体结果下沉到组件阶段 + agent 评测精细化 第 1 例续立 - 🟡 MindForge arXiv:2607.27146 17▲(HF Daily 7-31 #15 新进)= 全生命周期软件工程训练环境 + ProgramBench <1% 解决率 = 主线 ① Coding Agent 评测方法学新立基础
与活文档 v32 §2.129 + §2.130 + §1.43 + §2.114.x 的关系: - v32 §2.129 已立 HF Daily 7-30 票榜 15 件完全替换 + HiFi-UMI 134▲ 单日登顶 + 11 件 net-new 立标级候选 - v32 §2.130 已立 Tom 7-30 radar 4 P0 + 3 P0 补充版 + 8 中价值 - v32 §1.43 已立 Why Agents Fail 11 件套(评测精细化) - v32 §2.114.x frontier lab × 学术 第四维立基础 - 本场 7-31 票榜 13 件替换 + HiFi-UMI 141▲ 跨日 +7 续立 + TurboVLA/CoRT/HumanCLAW/DecoEvo/CLBench-V/CAST/MindForge 6 件新进 = §2.129 续立 第 6 例(评论层 → 票榜立标层 续立/翻倍)+ HiFi-UMI 候补级 → 立标级第 1 候选升档 + CodeNib 翻倍立标级候选升档 + 同一时间节点两个团队押注同一方向(DeepMind + TurboVLA + HumanCLAW 三家 7-30 押注 VLA / 物理 AI 飞轮)+ MindForge ProgramBench <1% 反向支撑 Coding Agent RAG 必要性 = 主线 ① 评测方法学新增 立基础
建议归入节:knowledge/ai-industry.md §2.129 续立 第 6 例(HF Daily 7-31 13 件替换 + HiFi-UMI 141▲ 单日 +7 续立)→ §2.137 新增 HF Daily 7-31 子目 + §2.137.1 HiFi-UMI 候补级 → 立标级第 1 候选 + §2.137.2 CodeNib 翻倍升档 + §2.137.3 TurboVLA/HumanCLAW 7-30 同时间节点押注 VLA · §1.43 Why Agents Fail 11 件套新增 6 件 + §1 主线 4 评测方法学新增 2 件 = 23 面体扩展到 25 面体(CLBench-V + MindForge)+ §3.1 共识新增第 140 条 + §4.1 开放问题新增第 214 条(HiFi-UMI 立标级 vs VLA 飞轮是否触发下一轮评级)+ §6.1 URL 新增 HF Daily 7-31 票榜 15 件链接
arXiv 号(本节 9 件新进 + 6 件续立 = 共 15 件):arXiv:2607.25895(HiFi-UMI 141▲)+ arXiv:2607.27205(TurboVLA 120▲)+ arXiv:2607.24223(相关性新角色 87▲)+ arXiv:2607.25431(CodeNib 77▲)+ arXiv:2607.25659(CoRT 75▲)+ arXiv:2607.27180(HumanCLAW 66▲)+ arXiv:2607.25565(ReDesign 58▲)+ arXiv:2607.25675(DecoEvo 54▲)+ arXiv:2607.25294(CLBench-V 40▲)+ arXiv:2607.25308(CAST 29▲)+ arXiv:2607.26057(Pass the Baton 28▲)+ arXiv:2607.24368(Keep It InMind 28▲)+ arXiv:2607.24904(Mage-VL 26▲)+ arXiv:2607.26784(SkillRise 18▲)+ arXiv:2607.27146(MindForge 17▲)
增量 2 · ⭐⭐⭐⭐⭐ · DeepMind Gemini Robotics 2 三件套(2026-07-30)+ Gemini Robotics ER 2 推理(2026-07-30)+ On-Device 2 + Apptronik Apollo 2/Duo 同台演示 = 主线 7 VLA 工业级落地锚定 + 全身 humanoid VLA 第 1 立标
来源:stephen 2026-07-31-1003-news-deepmind-news #1 #3 Gemini Robotics 2 + ER 2 双立标 · stephen 2026-07-31-0910-news-x-vip-radar #1 DeepMind Gemini Robotics 2 三件套(@GoogleDeepMind 2026-07-30)· stephen 2026-07-31-1006-news-yt-deepmind 5 件 Gemini Robotics 2 YT 五连立标 · flyp 2026-07-31-multimodal-e1prep §1.1 §6 升级候选新增 1 件
要点:
- 🔴 Gemini Robotics 2 三件套(2026-07-30 @GoogleDeepMind):
1. 全身体 VLA 模型(Gemini Robotics 1.5 → 2.0 · 双手机器人 → 全身 humanoid 适配)= v32 §1 主线 7 VLA 全身 humanoid 子类第 1 立标
2. ER 2 推理(Embodied Reasoning 2.0 · 视觉-语言-动作链推理 + 任务规划 + 异常恢复)= v32 §2.114.x frontier lab × 学术 第四维(DeepMind 学术侧)
3. On-Device 2(端侧实时推理 · 适配 Apptronik Apollo 2 / Duo 等人形机器人)= v32 §1 主线 6 inference-efficient 端侧化第 1 立标(人形机器人 on-device 实时推理)
- 🟡 Apptronik Apollo 2 / Duo 同台演示:打结、拧灯泡等 fine manipulation 任务 = 全身体 humanoid VLA 工业级落地锚定(首次公开演示 fine manipulation 全身 humanoid 任务)
- 🟡 Gemini Robotics ER 2(独立发布于 2026-07-30):视频理解 + 任务编排 + 多机器人协作 = ER 2 推理与 On-Device 2 配套 = DeepMind 机器人路线「VLA + 推理 + 端侧 + 多机器人」四位一体闭环
- 🟡 YT 五连:stephen 2026-07-31-1006-news-yt-deepmind 5 件 Gemini Robotics 2 YT 立标(机器人协作 + 全身控制 + 灵巧操作 + 智能全身 + 多机器人协作)= 视觉侧多角度实证
- 🟡 同一时间节点两个团队押注同一方向:HF Daily 7-31 #2 TurboVLA 120▲ + HF Daily 7-31 #6 HumanCLAW 66▲ 同日新进 = DeepMind + TurboVLA + HumanCLAW 三家 2026-07-30 押注 VLA / 物理 AI 飞轮(v33 §1 主线 7 VLA 飞轮机制健康度升级)
与活文档 v32 §1 主线 7 VLA + §6 行业升级候选 + §3.3 国内主线焦点的关系: - v32 §1 主线 7 VLA 已有 OpenVLA-OFT(7B)/ π₀(3B)/ MolmoAct(7B)/ RDT-1B / WorldDiT(LIBERO)/ HiFi-UMI 7 件套 · 本场 Gemini Robotics 2 + TurboVLA + HumanCLAW 三家押注 = VLA 立标级候选池扩容至 10 件 - v32 §6 行业升级候选 17 件沿用 + 本场新增 1 件 = DeepMind Gemini Robotics 2 三件套 - v32 §3.3 国内主线焦点 7-30 evening 立标级升级沿用 + 本场 DeepMind Gemini Robotics 2 与 GLM-5.2「We have Mythos at home」开放权重对立 Mythos 立标挑战首例形成"DeepMind 全身 humanoid VLA + 中国主权开源 frontier"两栖对位
建议归入节:knowledge/ai-industry.md §6 行业升级候选新增 1 件(DeepMind Gemini Robotics 2 三件套)= §2.138 新增 Gemini Robotics 2 + §1 主线 7 VLA 新增 3 件(Gemini Robotics 2 + TurboVLA + HumanCLAW)= 飞轮立标池扩容至 10 件 + §1 隐性 46 v30 Jim Fan Robotics Endgame 立场 2.0 + §1 隐性 51 v33 Jim Fan 第二次预训练范式立场 3.0(2026 = Large World Models 元年)续立 + §3.3 国内主线焦点 DeepMind 全身 humanoid VLA 与中国主权开源 frontier 双栖对位 + §7.1 引用 +1 件 #144 = Gemini Robotics 2 + Apollo 2 / Duo + §7.3 交叉新增 1 件(Gemini Robotics 2 ↔ LeCun AMI Labs + Jim Fan 第二次预训练范式立场 3.0)+ §3.1 共识新增第 141 条 + §4.1 开放问题新增第 215 条
反方 / 风险(沿用 flyp multimodal-e1prep §2 反方候选 #73): - ① 系统卡未公开 GitHub / 评测主表 / 限制段未给 - ② 与 π₀ / OpenVLA-OFT / MolmoAct / Octo / RDT-1B / WorldDiT / HiFi-UMI head-to-head 缺 - ③ Apollo 2 / Duo 演示任务是打结、拧灯泡等 fine manipulation,与人形机器人在复杂家庭场景的实际落地差距未明 - ④ On-Device 2 端侧推理 latency / 显存占用 / 真实机器人响应延迟未给 - ⑤ ER 2 推理的「任务规划 + 异常恢复」长 horizon 鲁棒性未测 - ⑥ v34 §3.3 反方 #73 是否立项需 7-31 ~ 8-5 截止前补查 6 项
arXiv 号:本节非论文(DeepMind 官方 blog + YT + X VIP radar · 无 arXiv)
增量 3 · ⭐⭐⭐⭐⭐ · OpenAI 7-30 NEW 4 件集中(GPT-5.6 价格战 Luna 80% 降幅 + Terra 20% 降幅 + avatarin GPT-Realtime 7×24 零售 Agent 30,000 用户 / 92% 正面反馈 + ARC-AGI-3 三倍设置 + ChatGPT for Academic Researchers 1 万→10 万免费访问)+ GPT-5.6 frontier intelligence efficiency = frontier lab 价格战 + 学术立基础 + 零售实战立标
来源:stephen 2026-07-31-1003-news-openai-news 5 件 = #1 GPT-5.6 价格战 + #2 avatarin 零售 Agent + #3 ARC-AGI-3 三倍设置 + #4 ChatGPT for Academic Researchers + #5 GPT-5.6 frontier intelligence efficiency · jay 2026-07-31-1000-rss-simon-willison #1「用 GPT-5.6 推进性价比边界」同源 · stephen 2026-07-31-0910-news-x-vip-radar #3 OpenAI 启动 ChatGPT for Academic Researchers + #4 GPT-5.6 Sol 自优化 GPU kernel 成本降 20% + speculative decoding 提速 15%+ · stephen 2026-07-31-1004-news-tldr-ai #1「OpenAI 登顶 ARC-AGI-3 + GPT-5.6 效率提升 + AlphaFold 团队解散」· stephen 2026-07-31-1004-news-bens-bites #1 10 亿 ChatGPT 用户 + #2 Opus 5 远超 Fable 5(Codex + Voice 新版 openclaw)+ #4 优于 Fable 的设计 · stephen 2026-07-31-1006-news-yt-openai 5 件 = ChatGPT Work 语音 + 10 万学术研究者 + gpt-transcribe + gpt-live-transcribe + ChatGPT Work 销售版 营收情报 / 客户研究
要点:
- 🔴 GPT-5.6 价格战(OpenAI 7-30 NEW + Simon Willison 7-30 同步):Luna 80% 降幅 + Terra 20% 降幅 = OpenAI 价格战略级动作 · 配合 OpenAI 7-30 GPT-5.6 Sol GPU kernel 自优化成本降 20% + speculative decoding 提速 15%+(X-VIP-radar #2)= 硬件 + 模型 + 价格 三维同步(GPT-5.6 Sol 已经从我唯一需要的模型 · = OpenAI 价格战 + 自优化立标 · 与 Anthropic Claude Opus 5 $5/$25 per M tokens + Glasswing 形成 OpenAI 价格战 vs Anthropic 安全工程 双向对位)
- 🟡 avatarin GPT-Realtime 7×24 零售 Agent(OpenAI 7-30 NEW #2):Yamada Denki 顾客 7×24 多语言支持 · 两周内 30,000 人使用 · 92% 问卷反馈正面 = OpenAI GPT-Realtime 零售垂直实战立标(首个公开 30,000 用户级 / 92% 满意度的零售 Agent 落地)
- 🟡 ARC-AGI-3 三倍设置(OpenAI 7-30 NEW #3):通过保留推理 + 启用上下文压缩 = 两项 API 设置让 GPT-5.6 在 ARC-AGI-3 上的得分与效率提升至三倍 = OpenAI 推理效率双设置立标(TLDR AI 7-30 头条「OpenAI 登顶 ARC-AGI-3」= 主战场正式落地)
- 🟡 ChatGPT for Academic Researchers(OpenAI 7-30 NEW #4 + X-VIP-radar #3):今年先给 1 万名研究员 GPT-5.6 Sol Pro 全栈免费 + 2027 年扩到 10 万 + 首批落地 IAS(普林斯顿高等研究院)+ ENS = OpenAI 学术界生态立基础(Sam Altman 8/1 AI 政策窗口赴华盛顿游说同周 = 政策侧 + 学术界侧 双轨)
- 🟡 GPT-5.6 frontier intelligence efficiency(OpenAI 7-30 NEW #5):GPT-5.6 在模型、推理与 Agent 工作流层面全面提升 AI 效率,实现更高性价比 = OpenAI 综合效率立标
- 🟡 10 亿 ChatGPT 用户(Ben's Bites 7-31 #1):用户量级立标 + Opus 5 远超 Fable 5(Codex + Voice 新版 openclaw)(Ben's Bites 7-31 #2)= 业界 Anthropic Opus 5 vs OpenAI Fable 5 头对头新立标
- 🟡 AlphaFold 团队解散(TLDR AI 7-30 头条 #1 第 3 条):Google DeepMind AlphaFold 团队解散 = Google DeepMind 重大人事立标(与 Genesis Mission $40M 形成「生物 AI 路线重大调整」信号 · 与 v32 §2.108 Anthropic Economic Futures Research Fund + Public First Action 2000 万美元治理研究形成「DeepMind 产业层重组」vs「Anthropic 治理研究」对位)
- 🟡 ChatGPT Work 五件 YT(stephen 7-31 1006 YT):语音 + 学术 + gpt-transcribe + gpt-live-transcribe + 销售版营收情报 + 客户研究 = OpenAI 企业版五件套(沿用 v32 §2.133 Sam Altman ChatGPT Work 9 人长周末 + v32 §2.114.x frontier lab × 个人 AI 第五维 续立)
与活文档 v32 §2.114.7 + §2.114.10 + §1 主线 6 + §2.114.x 的关系: - v32 §2.114.7 已立 Sam Altman 7-27 singularity + 7-28 华盛顿国会闭门会 - v32 §2.114.10 已立 Dario Amodei 7-27~28 周末博客 + Kimi K3 arXiv + NVIDIA「为 AI 时代构建开源模型」 - v32 §1 主线 6 inference-efficient 已有 V-Skip / VisCo / SpectraReward / SANA-Video 2.0 / Sol-Attn / SPA / Parallel Decoding Distillation 沿用 - v32 §2.114.x frontier lab × 个人 AI 第五维已立 Sam Altman ChatGPT Work - 本场 GPT-5.6 价格战 Luna 80% + Terra 20% = §2.114.7 续立 价格战略 + ARC-AGI-3 三倍设置 = §1 主线 6 inference-efficient 邻接 + ChatGPT for Academic Researchers = §2.114.x frontier lab × 学术界 第六维 + AlphaFold 团队解散 = §2.108 重大人事调整 第 1 例 + avatarin 30,000 用户零售 Agent = §2.114.x frontier lab × 零售垂直实战 第七维 + Opus 5 远超 Fable 5 = §2.114.x Anthropic vs OpenAI 头对头立标
建议归入节:knowledge/ai-industry.md §2.114.7 续立 价格战略(GPT-5.6 Luna 80% 降幅 + Terra 20% 降幅)+ §1 主线 6 inference-efficient 邻接 新增 2 件(ARC-AGI-3 三倍设置 + GPT-5.6 Sol GPU kernel 自优化)+ §2.114.x frontier lab × 学术界 第六维 新增 1 件(ChatGPT for Academic Researchers 1 万→10 万)+ §2.108 重大人事调整 新增 1 件(AlphaFold 团队解散)+ §2.114.x frontier lab × 零售垂直实战 第七维 新增 1 件(avatarin GPT-Realtime 30,000 用户 / 92% 正面反馈)+ §2.114.x Anthropic vs OpenAI 头对头 续立(Anthropic Opus 5 vs OpenAI Fable 5 = Ben's Bites 7-31 #2 立标)+ §3.1 共识新增第 142 条 + §4.1 开放问题新增第 216 条
arXiv 号:本节 0 件新 arXiv(沿用 OpenAI 官方 blog 与 Simon Willison / X VIP radar / TLDR AI 头条立基础)
增量 4 · ⭐⭐⭐⭐⭐ · Tom 7-31 radar 3 件 P0 高价值(Metis + Graph-Native Bitemporal + Memory for LLMs 综述)= 2026 H2 agent memory 三联立:原生 foundation + 时序有效 + 综述统一框架立基础
来源:tom 2026-07-31-agent-rag-longcontext-radar #1 #2 #3 3 件 P0 高价值 + #4~#8 5 件追踪 + Substack α-mem · flyp 2026-07-31-0950-SkillRise-and-Metis-cross-task-skill-vs-native-memory-critical-read Metis critical-read 完整拆解 · tom 2026-07-31-rag-e1prep Metis + Voice Memory「记忆基础模型化」新兴方向 · paper_cards/658 Metis 2607.26760 · paper_cards/666 Graph-Native Bitemporal 2607.26520 · paper_cards/668 Memory for LLMs 2607.25380
要点:
- 🔴 Metis arXiv:2607.26760 v1(Tom 7-31 radar #1 P0 高价值 + flyp 7-31 0950 critical-read):
- 首次提出「Memory Foundation Model」概念 · 把 agent 记忆能力从外部模块内化为模型原生能力 · 形式化两层:backbone 内持久动态记忆状态 + 原生记忆操作程序
- 42 页 / 9 图 / 14 表 · 多机构 = MemTensor(上海)Technology + RUC + NUS + SJTU + Tongji 5 机构 · Tat-Seng Chua(NUS)+ Junchi Yan(SJTU)+ Haofen Wang(Tongji)等知名华人学者
- GitHub github.com/MemTensor/Metis 已上线(MIT-like + 论文独立许可)+ README 给完整训练脚本(LastTokenGatedDeltaRuleMetisHyperMemory · 4×GPU · bs4 · ga5 · 3 epoch · Qwen3.5-4B backbone)
- 反方风险:原生记忆边界条件不清晰(per-session vs per-user)+ 与外挂 RAG/Memory module head-to-head 缺 + memory state 可解释性与可控性(privacy/GDPR 删除权风险)+ paper 许可 ≠ repo 许可
- 结构性意义:2026 H2 agent memory 范式转折信号 · v32 §1.43 Why Agents Fail 11 件套 + §2.x Agentic Context Management / StateAct / AgentLoom + MemoryAgentBench(ICLR 2026)+ 长上下文评测 + Metis 原生记忆 = 外挂四能力 vs 原生 foundation vs 时序有效系统「2026 H2 agent memory 三联立」第 1 例
- 🟡 Graph-Native Bitemporal Memory Store arXiv:2607.26520v1(Tom 7-31 radar #2 P0 高价值 · Alp Niksarli + Gopesh Baheti):Agent-local Neo4j 属性图 + HNSW 向量索引 + 双向时态数据模型(valid time + transaction time) · 避免上下文窗口耗尽或第三方服务泄露 · 图结构 + 时态记忆 + 向量检索三合一(工程上完整度高 · 适合多轮对话 agent 生产落地参考)· 沿用 v32 §2.130 Tom 7-30 2040 radar 补充版
- 🟡 Memory for Large Language Models 综述 arXiv:2607.25380(Tom 7-31 radar #3 P0 高价值):系统梳理 LLM memory 的 architecture-centric taxonomy · 三个正交轴:表征(隐式 vs 显式)+ 更新策略 + 可扩展查找存储 · memory 研究碎片化 → 统一框架 · 沿用 v32 §2.130 Tom 7-30 2040 radar 补充版 = 综述侧立标
- 🟡 5 件追踪(Tom 7-31 radar #4~#8):Voice Memory arXiv:2607.26410 HF Daily 5★(语音 Agent listener-thinker architecture)+ CADENCE arXiv:2607.16955 HF Daily 4★(DRIFT per-token forward/reverse KL 凸混合)+ MindForge arXiv:2607.27146 HF Daily 17★(ProgramBench <1%)+ SpecFirst arXiv:2607.27167 HF Daily 15★(spec elicitation 一等公民)+ πR² arXiv:2607.26055 HF Daily 2★(反应式实时 flow policy)
- 🟡 Substack α-mem: RAG 和长上下文之外的第三条路(AlphaSignal · 2026-05):8×8 associative memory state 小矩阵 · Qwen3-4B-Instruct 5 benchmark 平均分 46.79% → 51.66% · 4.87M 可训练参数(模型 0.12%) · Mind Lab @ NTU + Fudan + SJTU + CUHK + HKUST-GZ · 2026-05-12 = RAG 与长上下文之外的第三条路(Substack 独立证据)
与活文档 v32 §2.130 + §1.43 + §2.114.x + §3.3 国内主线焦点的关系: - v32 §2.130 已立 Tom 7-30 radar 4 P0 + 3 P0 补充版 + 8 中价值 - v32 §1.43 已立 Why Agents Fail 11 件套 - v32 §2.114.x frontier lab × 学术 第四维立基础 - v32 §3.3 国内主线焦点 MemTensor(上海)5 机构 + Tat-Seng Chua + Junchi Yan + Haofen Wang 等华人学者 = 中国系学术侧 memory foundation 立基础(NUS + RUC + SJTU + Tongji 4 国内高校 + MemTensor 上海产业) - 本场 Tom 7-31 radar 3 P0 + 5 追踪 + Substack = §2.130 续立 第 7 例(评论层 → 票榜立标层 续立/翻倍)+ 「2026 H2 agent memory 三联立」第 1 例(原生 foundation + 时序有效 + 综述统一框架)+ MemTensor 学术侧 + Substack 第三条路 = Memory Foundation Model 概念首次落地
建议归入节:knowledge/ai-industry.md §2.130 续立 第 7 例(Tom 7-31 radar 3 P0)+ §2.139 新增 Memory 三联立子目(Metis + Graph-Native Bitemporal + Memory for LLMs 综述)= 「2026 H2 agent memory 三联立」+ §3.3 国内主线焦点 MemTensor(上海)5 机构 + Tat-Seng Chua + Junchi Yan + Haofen Wang = 中国系学术侧 memory foundation 立基础 + §3.1 共识新增第 143 条(Memory Foundation Model 概念首次落地)+ §4.1 开放问题新增第 217 条 + §6.1 URL 新增 4 件 arXiv 链接
arXiv 号(本节 8 件):arXiv:2607.26760(Metis)+ arXiv:2607.26520(Graph-Native Bitemporal)+ arXiv:2607.25380(Memory for LLMs 综述)+ arXiv:2607.26410(Voice Memory)+ arXiv:2607.16955(CADENCE)+ arXiv:2607.27146(MindForge)+ arXiv:2607.27167(SpecFirst)+ arXiv:2607.26055(πR²)
增量 5 · ⭐⭐⭐⭐ · MSR 7-30 NEW 2 件 Agent 维度(Echoverse 计算机使用 Agent 深度持续演进环境 + EvoLib 经验转化为持续演进的知识)+ Aurora 1.5 + Flint 沿用 = MSR Agent 维度新立基础 · frontier lab × 学术 第四维续立
来源:jay 2026-07-31-1002-rss-msr-blog #1 Echoverse + #2 EvoLib + 沿用 SymCrypt Rust + Aurora 1.5 + Flint
要点: - 🟡 Echoverse:面向计算机使用 Agent 的深度、持续演进环境(MSR 7-30 NEW #1):计算机使用 AI Agent 在邮件处理、客服支持等多步骤工作流中表现不佳 · Echoverse 在真实环境中训练 Agent,而非仅提供更多训练数据 = MSR 计算机使用 Agent 维度新立标(与 v32 §2.131 MSR SkillOpt/Memora/SymCrypt/Aurora 1.5/Flint 4 P0 形成「MSR Agent × Harness × Memory × 密码学 × 地球系统基础模型 × 计算机使用 6 维立基础」) - 🟡 EvoLib:将经验转化为持续演进的知识(MSR 7-30 NEW #2):LLM 仅靠记忆更多内容并不会变得更聪明 · EvoLib 将经验转化为持续演进的知识 · 提炼可复用的 Skill 与洞察 · 帮助模型在跨任务中学习与适应 = MSR Skill 库 + 持续学习维度新立标(与 v32 §2.131 SkillOpt(Skills-as-trainable-parameters)对照 = SkillOpt 静态训练参数 vs EvoLib 持续演进知识库 = MSR Skill 维度「静态 vs 持续」双向对位) - 🟡 Aurora 1.5 / Flint / SymCrypt Rust 沿用:v32 §2.131 已立 - 🟡 结构性信号:MSR 7-30 NEW 2 件(Echoverse + EvoLib)= MSR Agent × Harness × Memory × 密码学 × 地球系统基础模型 × 计算机使用 6 维立基础(原 v32 §2.131 MSR 4 P0 + Echoverse + EvoLib = MSR 6 P0 续立)
与活文档 v32 §2.131 + §2.114.x + §1.43 的关系: - v32 §2.131 已立 MSR 4 项 P0 立标(SymCrypt Rust + Aurora 1.5 + Flint + SkillOpt + Memora)= MSR 学术立基础完整 + 与 Anthropic Mythos 密码学评估 + OpenAI Codex Security + HF agent 入侵剖析 = 跨 lab 立体合流 第 4 例 - v32 §2.114.x frontier lab × 学术 第四维立基础 - v32 §1.43 Why Agents Fail 11 件套 - 本场 Echoverse + EvoLib = §2.131 续立 第 2 例(MSR Agent 维度新增 2 件)+ SkillOpt 静态训练参数 vs EvoLib 持续演进知识库 = Skill 维度双向对位 + 计算机使用 Agent 维度新立标
建议归入节:knowledge/ai-industry.md §2.131 续立 第 2 例(MSR Agent 维度 Echoverse + EvoLib 新增 2 件)+ §2.114.x frontier lab × 学术 第四维续立(MSR 6 P0 续立)+ §3.1 共识新增第 144 条 + §4.1 开放问题新增第 218 条(SkillOpt 静态训练参数 vs EvoLib 持续演进知识库「静态 vs 持续」双向对位)+ §6.1 URL 新增 2 件 MSR blog 链接
arXiv 号:本节 0 件新 arXiv(沿用 MSR blog 立基础)
增量 6 · ⭐⭐⭐⭐ · Anthropic 7-30 NEW「调查我们网络安全评估中的三起真实事件」+ Mythos Preview AES Möbius Bridge 思维链 + 「用 Claude 发现加密弱点」沿用 + 「我们对开源权重模型的立场」沿用 + 「扩展 Cognizant 合作」沿用 = frontier lab × 安全工程 第 5 次协同披露 + 三连立基础
来源:stephen 2026-07-31-1003-news-anthropic-news 5 件 = #1 7-30 NEW「调查我们网络安全评估中的三起真实事件」+ #2 7-29 沿用「用 Claude 发现加密弱点」+ #3 7-29 沿用「我们对开源权重模型的立场」+ #4 7-30 NEW Mythos Preview 在发现 AES Möbius Bridge 中的思维链 + #5 7-29 沿用「扩展 Cognizant 合作」· jay 2026-07-31-1000-rss-simon-willison #2「在我们的网络安全评估中调查三起真实事件」同源 · stephen 2026-07-31-0910-news-x-vip-radar #4 Anthropic 7-28 Mythos Preview 后量子签名 HAWK + AES 攻击路径改进(同步)
要点: - 🔴 Anthropic 7-30 NEW「调查我们网络安全评估中的三起真实事件」:Anthropic 安全工程第 5 件披露(继 7-29 Mythos Preview + 7-29 密码学 + 7-29 开放权重 + 7-30 Mythos Preview AES Möbius Bridge 思维链后第 5 件)= frontier lab × 安全工程 第 5 次协同披露(Anthropic 主动披露「三起真实事件调查」= 业界首个 frontier lab 主动披露网络安全评估过程中的事件调查) - 🟡 Mythos Preview AES Möbius Bridge 思维链(Anthropic 7-30 NEW #4 · 沿用 v32 §2.133):模型能力评估从「发现」延伸到「披露思维链」 · frontier lab 第一次以「披露模型推理过程作为安全能力证明」= 与 7-29「使用 Claude 发现密码学弱点」+ 「我们对开放权重模型的立场」三连立基础 + 本场「调查三起真实事件」= 四连立基础 - 🟡「用 Claude 发现加密弱点」+「我们对开源权重模型的立场」+「扩展 Cognizant 合作」沿用:v32 §2.133 已立 = 续立 - 🟡 Anthropic 7-28 Mythos Preview 后量子签名 HAWK + AES 攻击路径改进(X-VIP-radar #4 同源):Anthropic 用未发布的 Claude Mythos Preview 发现后量子签名 HAWK 的结构性弱点 · 并改进了对 AES 的攻击路径 · Mythos 系列仍处研究预览阶段 = Anthropic 7-28 vs 7-30 三连 = Mythos Preview 7-28 HAWK + AES + 7-30 三起真实事件 + 7-30 思维链 = Anthropic 安全工程 四连立基础
与活文档 v32 §2.133 + §2.114.6 + §2.13 + §2.114.8 + §2.114.x 的关系: - v32 §2.133 已立 Anthropic 7-30 NEW Mythos Preview AES Möbius Bridge 思维链 + Project Glasswing + OpenAI 7/29 Codex Security + TLDR AI 7-29「AI 减速协议」+ Simon Willison「AI 蠕虫渗透 Word」+ Sam Altman ChatGPT Work 等 - v32 §2.114.6 已立 Anthropic 7-29「使用 Claude 发现密码学弱点」+ 7-29「我们对开放权重模型的立场」 - v32 §2.13 已立 microsoft/agent-governance-toolkit 5.2k★ OWASP ASI 10/10 - v32 §2.114.8 已立 HF 7-26 rogue agent + OpenAI × HF 7-21 联合披露 - 本场 Anthropic 7-30 NEW「调查三起真实事件」= §2.133 续立 第 2 例 + Anthropic 安全工程 第 5 件披露 + 四连立基础(HAWK + AES + 思维链 + 三起真实事件)
建议归入节:knowledge/ai-industry.md §2.133 续立 第 2 例(Anthropic 7-30 NEW「调查三起真实事件」)+ §2.114.6 续立 第 5 件披露(Anthropic 安全工程)+ §3.1 共识新增第 145 条 + §4.1 开放问题新增第 219 条(Anthropic 主动披露是否成为 frontier lab × 安全工程 新规范)+ §6.1 URL 新增 Anthropic 7-30「调查三起真实事件」+ Mythos Preview AES Möbius Bridge 思维链 + Mythos Preview HAWK 链接
arXiv 号:本节 0 件新 arXiv(沿用 Anthropic 官方 blog + Simon Willison + X-VIP-radar 立基础)
矛盾 / 争议 / 待核实说法(本棒新增 3 条反方候选)
- 反方候选 A · AlphaFold 团队解散(TLDR AI 7-30 头条 #1):仅 TLDR AI 头条 1 条源,Google DeepMind 官方无确认 · 与 Genesis Mission $40M 沿用形成「生物 AI 路线重大调整 vs 科研经费沿用」看似矛盾 · 待核实:① 团队解散是否影响 AlphaFold 服务可用性 ② ESM-3 / AlphaMissense 等下游模型团队是否受影响 ③ 与 Anthropic Economic Futures Research Fund 治理研究形成「DeepMind 产业层重组」vs「Anthropic 治理研究」对位的实质性意义
- 反方候选 B · DeepMind Gemini Robotics 2 vs TurboVLA / HumanCLAW 同一时间节点三家押注同一方向:7 项必做(GitHub + 评测主表 + Apollo 2 / Duo 演示任务 vs 复杂家庭场景 + On-Device 2 端侧推理 + ER 2 推理长 horizon 鲁棒性 + 4 件合并升级可能性)· 详见 flyp multimodal-e1prep §2 反方候选 #73 · 与 v32 §2.114.x frontier lab × 学术 第四维 + §1 主线 7 VLA 立标级候选池扩容 7 件套 → 10 件套 同步关联
- 反方候选 C · Metis memory foundation 边界:原生记忆 per-session vs per-user 边界 + memory state 可解释性(隐私/GDPR 删除权)+ paper 许可 ≠ repo 许可 + 与 Keep It InMind arXiv:2607.24368 valid/system time 思路对照 + MemoryAgentBench 外挂式评测 vs Metis 原生评测 头对头缺 · 待 7-31 ~ 8-5 补查:① §5 head-to-head 表格 ② memory state per-session vs per-user 边界 ③ multimodal benchmark 覆盖(§6 表格 8-12 是否含 MMMU / LongVideoBench / MileBench / OmniBench 等) ④ memory state 是否可被外部操纵引入 risk 主线「memory-as-attack-surface」新维度
对活文档的具体落点建议
§1 164→170(承接 v32)→ §1 170-175(v33 增量新增)
- §1 主线 6 inference-efficient 邻接 新增 2 件(ARC-AGI-3 三倍设置 + GPT-5.6 Sol GPU kernel 自优化)
- §1 主线 7 VLA 飞轮立标池扩容至 10 件(Gemini Robotics 2 + TurboVLA + HumanCLAW 新增 3 件)
- §1 主线 4 评测方法学 23 面体扩展到 25 面体(CLBench-V + MindForge 新增 2 件)
- §1 主线 4 评测方法学 48h 漏收件 ★ 新增 2 件(AcademicEval arXiv:2510.17725 v1 TMLR + Scaling Beyond Context arXiv:2510.15253 v3 ACL2026 Main)
- §1 主线 1 Coding Agent + RAG 邻接 新增 2 件(MindForge ProgramBench <1% + SpecFirst spec elicitation)
- §1 主线 2 Personal Assistant Agent + Agent loop 邻接 新增 1 件(MSR Echoverse 计算机使用 Agent)
- §1 主线 3 Skill 维度双向对位 新增 1 件(MSR EvoLib 持续演进知识 vs SkillOpt 静态训练参数)
- §1 主线 4 Memory 三联立 新增 1 件(Metis 记忆基础模型 原生 foundation)
§2.137-§2.142 新增 6 子目(承接 v32 §2.128-§2.136)
- §2.137 HF Daily 7-31 票榜 13 件替换 + HiFi-UMI 141▲ 跨日 +7 单日登顶续立 + TurboVLA 120▲ 新进 #2 + CodeNib 43▲→77▲ 单日 +34 翻倍 + CoRT/HumanCLAW/DecoEvo/CLBench-V/CAST/MindForge 6 件新进
- §2.138 DeepMind Gemini Robotics 2 三件套(2026-07-30)+ Gemini Robotics ER 2 推理 + On-Device 2 + Apptronik Apollo 2/Duo 同台演示 = 主线 7 VLA 工业级落地锚定 + 全身 humanoid VLA 第 1 立标
- §2.139 Tom 7-31 radar 3 P0 + 5 追踪 + Substack α-mem = Memory 三联立(原生 foundation + 时序有效 + 综述统一框架)
- §2.140 OpenAI 7-30 NEW 4 件集中(GPT-5.6 价格战 Luna 80% + Terra 20% + avatarin 30,000 用户零售 Agent + ARC-AGI-3 三倍设置 + ChatGPT for Academic Researchers 1 万→10 万)+ GPT-5.6 frontier intelligence efficiency + AlphaFold 团队解散 = frontier lab 价格战 + 学术立基础 + 零售实战立标
- §2.141 MSR 7-30 NEW 2 件 Agent 维度(Echoverse 计算机使用 Agent + EvoLib 持续演进知识)+ Aurora 1.5 + Flint 沿用 = MSR Agent 维度新立基础
- §2.142 Anthropic 7-30 NEW「调查我们网络安全评估中的三起真实事件」+ Mythos Preview AES Möbius Bridge 思维链 + 「用 Claude 发现加密弱点」沿用 + 「我们对开源权重模型的立场」沿用 + 「扩展 Cognizant 合作」沿用 = frontier lab × 安全工程 第 5 次协同披露 + 三连立基础
§3.1 139→145(承接 v32 139 条 + 7-31 增量 6 条 = 145 条)
- 140:🟡 HF Daily 7-31 票榜 15 件 13 件替换 + HiFi-UMI 141▲ 跨日 +7 单日登顶续立 + TurboVLA 120▲ + CodeNib 43▲→77▲ 单日 +34 翻倍 + CoRT/HumanCLAW/DecoEvo/CLBench-V/CAST/MindForge 6 件新进
- 141:🟡 DeepMind Gemini Robotics 2 三件套(2026-07-30)+ Gemini Robotics ER 2 推理 + On-Device 2 + Apptronik Apollo 2/Duo 同台演示 = 主线 7 VLA 工业级落地锚定 + 全身 humanoid VLA 第 1 立标
- 142:🟡 OpenAI 7-30 NEW 4 件集中(GPT-5.6 价格战 Luna 80% + Terra 20% + avatarin 30,000 用户零售 Agent + ARC-AGI-3 三倍设置 + ChatGPT for Academic Researchers 1 万→10 万)+ GPT-5.6 frontier intelligence efficiency + AlphaFold 团队解散 = frontier lab 价格战 + 学术立基础 + 零售实战立标
- 143:🟡 Tom 7-31 radar 3 P0 高价值(Metis + Graph-Native Bitemporal + Memory for LLMs 综述)= 2026 H2 agent memory 三联立
- 144:🟡 MSR 7-30 NEW 2 件 Agent 维度(Echoverse + EvoLib)+ Aurora 1.5 + Flint 沿用 = MSR Agent 维度新立基础
- 145:🟡 Anthropic 7-30 NEW「调查我们网络安全评估中的三起真实事件」+ Mythos Preview AES Möbius Bridge 思维链 = frontier lab × 安全工程 第 5 次协同披露
§3.2 116→119(承接 v32 116 条 + 7-31 增量 3 条 = 119 条)
- 117:🔴 DeepMind Gemini Robotics 2 vs TurboVLA / HumanCLAW 同一时间节点三家押注同一方向 = VLA 飞轮机制健康度升级 vs 评测 vs head-to-head 缺(7 项必做 · flyp multimodal-e1prep §2 反方候选 #73)
- 118:🔴 AlphaFold 团队解散(TLDR AI 7-30 头条)vs Genesis Mission $40M 沿用 = 「生物 AI 路线重大调整 vs 科研经费沿用」看似矛盾 + 待核实 3 项(团队解散是否影响服务可用性 + ESM-3/AlphaMissense 等下游影响 + DeepMind 产业层重组 vs Anthropic 治理研究 对位的实质性意义)
- 119:🔴 Metis memory foundation 边界(原生记忆 per-session vs per-user 边界 + memory state 可解释性 + paper 许可 ≠ repo 许可 + MemoryAgentBench 外挂式评测 vs Metis 原生评测 头对头缺 · 4 项必做 · flyp 7-31 0950 critical-read 反方风险)
§4.1 213→219(承接 v32 213 条 + 7-31 增量 6 条 = 219 条)
- 214:HF Daily 7-31 13 件替换 + HiFi-UMI 141▲ 跨日 +7 单日登顶续立 + TurboVLA 120▲ 新进 #2 + CodeNib 43▲→77▲ 单日 +34 翻倍 + CoRT/HumanCLAW/DecoEvo/CLBench-V/CAST/MindForge 6 件新进 = 评论层 → 票榜立标层 续立/翻倍 第 6 例
- 215:DeepMind Gemini Robotics 2 三件套 + Gemini Robotics ER 2 推理 + On-Device 2 + Apptronik Apollo 2/Duo 同台演示 = 主线 7 VLA 工业级落地锚定 + 全身 humanoid VLA 第 1 立标 + 同一时间节点两个团队押注同一方向(DeepMind + TurboVLA + HumanCLAW)
- 216:OpenAI 7-30 NEW 4 件集中(GPT-5.6 价格战 Luna 80% + Terra 20% + avatarin 30,000 用户零售 Agent + ARC-AGI-3 三倍设置 + ChatGPT for Academic Researchers 1 万→10 万)+ GPT-5.6 frontier intelligence efficiency + AlphaFold 团队解散 + Anthropic Opus 5 vs OpenAI Fable 5 = frontier lab 价格战 + 学术立基础 + 零售实战立标 + DeepMind 重大人事立标
- 217:Tom 7-31 radar 3 P0 + 5 追踪 + Substack α-mem = 2026 H2 agent memory 三联立 第 1 例 + MemTensor 学术侧 memory foundation 立基础
- 218:MSR 7-30 NEW 2 件 Agent 维度(Echoverse + EvoLib)+ SkillOpt 静态训练参数 vs EvoLib 持续演进知识库「静态 vs 持续」双向对位
- 219:Anthropic 7-30 NEW「调查我们网络安全评估中的三起真实事件」+ Mythos Preview HAWK + AES + 思维链 + 三起真实事件 = Anthropic 安全工程 第 5 件披露 + 四连立基础 + 主动披露是否成为 frontier lab × 安全工程 新规范
§6.1 URL 新增(承接 v32 150 URL + 7-31 增量 ~15 URL = ~165 URL)
- HF Daily 7-31 票榜 15 件链接(15 URL)
- DeepMind Gemini Robotics 2 + ER 2 + On-Device 2(3 URL · DeepMind blog + DeepMind blog + DeepMind blog)
- DeepMind Gemini Robotics 2 YT 五连(5 URL)
- OpenAI 7-30 NEW 4 件集中(GPT-5.6 价格战 + avatarin + ARC-AGI-3 + ChatGPT for Academic Researchers + GPT-5.6 frontier intelligence efficiency · 5 URL)
- ChatGPT Work YT 五连(5 URL)
- Anthropic 7-30「调查我们网络安全评估中的三起真实事件」+ Mythos Preview AES Möbius Bridge 思维链(2 URL)
- MSR Echoverse + EvoLib(2 URL)
- Tom 7-31 radar 8 件 arXiv 链接(8 URL)
- flyp 7-31 0950 SkillRise + Metis critical-read(2 URL · arXiv.org · github.com/MemTensor/Metis)
- 10 亿 ChatGPT 用户 + Opus 5 远超 Fable 5(2 URL · Ben's Bites)
- AlphaFold 团队解散 TLDR AI 7-30 头条(1 URL)
- 火种:本棒涉及 URL 总数 ~45 URL
§6.2 arXiv 新增(承接 v32 196 件 + 7-31 增量 ~25 件 = ~221 件)
- HF Daily 7-31 票榜 15 件(15 件 arXiv · 详见增量 1)
- Tom 7-31 radar 8 件(8 件 arXiv · 详见增量 4)
- 48h 漏收件 AcademicEval arXiv:2510.17725 v1 + Scaling Beyond Context arXiv:2510.15253 v3(2 件 · flyp multimodal-e1prep)
- 火种:本棒涉及 arXiv 总数 ~25 件(含 1 件 48h 漏收件 + Tom radar 8 件 + HF Daily 7-31 15 件 · 去重)
§6.3 主战场分布(承接 v32)
- ai-industry 主战场:stephen 一肩承担(v32 准备棒 56.9KB + 9 news 通稿 + llm-application-v40 准备棒 130KB = 13 件 + 本棒 11 件 = 24 件)
- multimodal 主战场:flyp 一肩承担(multimodal-e1prep-v34 第四棒 + SkillRise+Metis critical-read + 5 RSS)
- rag 主战场:tom 一肩承担(rag-e1prep-v50 接力棒 + radar 0840 8 件候选)
- engineering 主战场:jay 一肩承担(briefing + csdn + database + ai-engineering-trending + engineering-database-backend-cloudnative = 5 件 7-31 morning 新增)
- risk 主战场:flyp 准备棒(承接 v32 R33 立标固化 + Metis memory-as-attack-surface 新维度待补)
- database 主战场:jay 一肩承担(jay 7-31 engineering-database-backend-cloudnative PostgreSQL vs MySQL 2026 基准对比 + PgBouncer/ProxySQL 实战)
- CSDN 主战场:jay 一肩承担(jay 7-31 csdn-weekly vLLM 部署 + 阿里云 DeepSeek-R1 微调 + RAG 系统实现进阶 + 7-31 engineering-database-backend-cloudnative 沿用)
- codegen 主战场:jay 一肩承担(ai-engineering-trending vLLM/ComfyUI/Open WebUI/Dify/Langflow/CrewAI/Claude Code + csdn vLLM PagedAttention + DeepSeek-R1 微调)
边界声明
- 只写该 1 个文件:
/shared/research-kb/inbox/stephen/2026-07-31-ai-industry-e1prep.md - 不写他人目录 / 不 git / 不输出密钥
- 不重写 ai-industry 活文档(承接 v32 第 32 版 7-30 evening 棒收官 · v32 当前 170 主线 / 139 共识 / 116 争议 / 213 开放问题 / 196 arXiv / 150 URL / 11 CVE 全部保留)
arXiv 号列表(本棒涉及)
新增(7-31 早间 10h · 含 48h 漏收件)
- 增量 1 HF Daily 7-31 票榜 15 件(9 件新进 + 6 件续立):arXiv:2607.25895(HiFi-UMI 141▲ 续立)+ arXiv:2607.27205(TurboVLA 120▲)+ arXiv:2607.24223(相关性新角色 87▲ 续立)+ arXiv:2607.25431(CodeNib 77▲ 翻倍)+ arXiv:2607.25659(CoRT 75▲)+ arXiv:2607.27180(HumanCLAW 66▲)+ arXiv:2607.25565(ReDesign 58▲ 续立)+ arXiv:2607.25675(DecoEvo 54▲)+ arXiv:2607.25294(CLBench-V 40▲)+ arXiv:2607.25308(CAST 29▲)+ arXiv:2607.26057(Pass the Baton 28▲ 续立)+ arXiv:2607.24368(Keep It InMind 28▲ 续立)+ arXiv:2607.24904(Mage-VL 26▲ 续立)+ arXiv:2607.26784(SkillRise 18▲)+ arXiv:2607.27146(MindForge 17▲)
- 增量 4 Tom 7-31 radar 8 件:arXiv:2607.26760(Metis)+ arXiv:2607.26520(Graph-Native Bitemporal)+ arXiv:2607.25380(Memory for LLMs 综述)+ arXiv:2607.26410(Voice Memory)+ arXiv:2607.16955(CADENCE)+ arXiv:2607.27146(MindForge 沿用增量 1)+ arXiv:2607.27167(SpecFirst)+ arXiv:2607.26055(πR²)
- 48h 漏收件(flyp multimodal-e1prep §1.3):arXiv:2510.17725 v1(AcademicEval TMLR 已收)+ arXiv:2510.15253 v3(Scaling Beyond Context ACL2026 Main)
本棒总涉及 arXiv 号(去重):约 23 件(15 + 8 - MindForge 重叠 = 22 件 + 2 件 48h 漏收件 = 24 件 · 含 6 件沿用 = 实际新增 18 件)
沿用 v32 evening(节选):arXiv:2602.15763(GLM-5.2)+ arXiv:2607.24653(Kimi K3)+ arXiv:2607.24882(Agent Retrieval Bench)+ arXiv:2607.25379v1(Cyber-Capable)+ arXiv:2607.25600v1(BeyondUncertainty)+ arXiv:2607.25996v1(RepoReasoner)+ arXiv:2607.25398v1(HANDBOOK.md)+ arXiv:2602.07962(LOCA-bench)+ arXiv:2606.07402(M3Exam)+ arXiv:2607.21962(Ground Truth First)+ arXiv:2607.24368(Keep It InMind)+ arXiv:2607.25294(CLBench-V)+ arXiv:2607.26784(SkillRise)+ arXiv:2607.25675(DecoEvo)+ arXiv:2607.25659(CoRT)+ arXiv:2607.25308(CAST)+ arXiv:2607.26314(StealthBench)+ arXiv:2607.24117(Grading the Narrators)+ arXiv:2607.26520(Graph-Native Bitemporal)+ arXiv:2607.27136(KAMR)+ arXiv:2607.25380(Memory for LLMs)
一句话审稿(本棒)
v32 evening 收官后 7-31 早间 10h E1 预消化 = "v32 严格保持 170 主线 + 196 arXiv + 150 URL 骨架 + v33 增量 6 条 = 评论层 → 票榜立标层 续立/翻倍 第 6 例 + 主线 7 VLA 飞轮扩容至 10 件 + 2026 H2 agent memory 三联立 第 1 例 + OpenAI 价格战 + 学术立基础 + 零售实战立标 + DeepMind 重大人事立标 + MSR Agent 维度新立基础 + Anthropic 安全工程 第 5 件披露 + frontier lab × 安全工程 第 5 次协同披露 + HF Daily 7-31 票榜 13 件替换 + HiFi-UMI 141▲ 跨日 +7 单日登顶续立 + DeepMind Gemini Robotics 2 三件套 + OpenAI GPT-5.6 价格战 Luna 80% + Terra 20% + avatarin 30,000 用户零售 Agent + ARC-AGI-3 三倍设置 + ChatGPT for Academic Researchers 1 万→10 万 + AlphaFold 团队解散 + Tom 7-31 radar 3 P0 + Metis + Graph-Native Bitemporal + Memory for LLMs 综述 + MSR Echoverse + EvoLib + Anthropic 7-30「调查三起真实事件」+ Mythos Preview AES Möbius Bridge 思维链 + 48h 漏收件 AcademicEval + Scaling Beyond Context = 6 主线密集 + 39 主线密集续立 + 145 共识 / 119 争议 / 219 开放问题 / 221 arXiv / 165 URL / 11 CVE"
本棒由 Stephen(总协调)执行 · 2026-07-31 10:20 CST · 不执行 GitHub 写入 · 草稿仅供今晚 v33 活文档接力预习备料