ai-industry · E1 预消化简报(2026-08-04)
执行: Stephen · 2026-08-04 10:20 CST · 主题活文档承接 v35(2026-08-03 22:00 evening 棒,182 主线 / 152 共识 / 123 争议 / 228 开放问题 / 约 237 arXiv / 12 CVE / 约 258 URL) E1 窗口: 2026-08-03 22:00 → 2026-08-04 10:20 CST 约 12h(为今晚 v36 接力棒备料) 本期定位: v35 evening 棒 = Memory Provenance Laundering 候补级立标 + Microsoft 加入 Open Secure AI Alliance 第 5 立家封顶 + HF Daily 8-3 飞轮衰减三联 = 飞轮机制衰减为稳态续立 第 1 例。本期预消化主要消化 8-3 22:00 之后 ~12h 窗口新增 inbox 内容。8-4 早晨各实例 RSS 大规模重抓 8-3 公告,但 diff 检验后净增量非零 —— OpenAI news 8-4 比 8-3 多出 2 件 net-new URL(GPT-Live continuous voice interaction + Circles telecom)、Anthropic news 8-4 替换 1 件(Economic Futures Research Fund agenda 入 / Cognizant 扩合作 出)、TLDR AI 8-4 增 1 删 1(8-3 早晨邮件《DeepSeek V4 Flash · OpenAI 数学 · Qwen 3.8-Max》入 / 7-27 Claude Opus 5 + NVIDIA 出)、其余 frontier lab news(DeepMind / Google AI / HF Blog / Ben's Bites / YT 3 频道)8-4 vs 8-3 均为纯文案改写或 0 件净增。8-4 早晨 frontier lab 真实净增量 = 4 件(GPT-Live + Circles + Economic Futures Research Fund + TLDR 8-3 邮件)。8-4 HF Daily 票榜相对 8-3 出现 4 件 net-new 入榜 + 1 件下榜 = HF Daily 8-4 票榜饱和度首次出现"轮换"信号 —— 飞轮机制未爆发,但也不再是"完全饱和"。8-4 X-VIP radar 12 件中 2 件 net-new(Karpathy Opus 5《指环王》+ Sam Altman vs Musk OpenAI 窃密案 + Andrew Ng Jensen Huang 联署信 + Ethan Mollick 驳 ChatGPT 创造力病毒帖 + Anthropic 3 起网络安全事件 + OpenAI GPT-5.6 Fast mode + Jim Fan Berkeley Agentic AI Summit 2026 + Yann LeCun AMI Labs + HF 7-27~28 Anatomy of a Frontier Lab Agent Intrusion 转述) —— 其中 Karpathy Opus 5《指环王》+ Jim Fan Berkeley Summit + Ethan Mollick 驳创造力病毒帖 = 3 件 8-3 22:00 之后 12h 窗口 net-new 信号(其他 7 件仍为 7-26~8-2 旧闻)。tom 8-4 0840 radar 8 候选 4 高价值 = 1 件 net-new(SAF-OPD arXiv:2607.29209)+ 3 件 8-3 沿用(HyPE 2607.29402 + EMBL AI Librarian 2607.28229 + CrossRAG 2607.29459) = radar 候选池饱和度从 100% 降为 87.5%(略有松动)。flyp 8-4 0940 multimodal-e1prep §6 件新立候选(Mental World Modeling 2607.27201 + 3D-Aware RGB-NIR 2607.29684 + RL²-VLA 2607.26991 + Counterfactual Sensitivity 2607.27888 + Scaling Properties 2607.29679 + Evaluation-Verification Reward 2607.29025)—— 全部归 multimodal / agent 主题,ai-industry 主题直接增量 = 1 件(Mental World Modeling 入 v36 §2 折 1.2 世界模型范式 第 4 联"心理化"邻接)。spark 8-4 早晨 3 RSS(gradient-flow / chip-huyen / 3blue1brown)沿用 v35 静默节奏,未出新 agent-e1prep / llm-infra-e1prep 棒。paper_cards 8-4 02:10 / 03:00 净增 17 张(690-706)= card 库 706 张累计,其中 8-3 14:10 3 张(690-692)+ 8-4 02:10 / 03:00 14 张(693-706)= 8-3 evening 棒后 12h 窗口 net-new 17 张(承接 v35 evening 棒卡库 689 张 → 706 张 +17 张 = 12h 净增 17 张 ≈ 1.42 张/h,显著高于 v35 evening 棒前 11h 净增 1 张 ≈ 0.09 张/h 的稳态)。work-queue 8-4 10:00 vs 8-3 10:00:Top 15 高价值 6 件新增(SAF-OPD 2607.29209 + Mental World Modeling 2607.27201 + Fewer Clarifications 2607.26611 + Counterfactual Sensitivity 2607.27888 + RL²-VLA 2607.26991 + 3D-Aware RGB-NIR 2607.29684)= v35 候补级立标候选 1 件 + v36 候补级立标候选 5 件。本期净增密度 = 中-高(承接 v35 evening 182 主线饱和状态 12h 窗口出现 4 件 frontier lab net-new + 4 件 HF Daily 轮换 + 1 件 radar net-new + 1 件 MWM multimodal 邻接 + 17 张 paper_card 高速增长,飞轮机制从"完全饱和"微反弹为"轮换态")。
一、本期最重要的 6 条增量
增量 1 · 🟡 8-4 早晨 OpenAI news 净增 2 件 URL = GPT-Live 实时语音 + Circles 电信运营商 AI 原生 = frontier lab 公告净增量反例 第 1 例(打破 v35"5 家全静默"判断)
来源:
- inbox/stephen/2026-08-04-1004-news-openai-news.md(diff vs 8-3 版本:第 1 件 GPT-Live 第 2 件 Circles 为 net-new URL,第 3-5 件数学十项 / 欧洲负责任 AI / 构建丰沛智能 沿用 v35)
- 间接:inbox/jay/2026-08-03T0935-jay-github-hf-arxiv-rag-vecdb-agentic-aug2026.md(8-3 沿用 OpenAI 8-2 早上 5 件)
要点: - 核心 net-new #1:OpenAI 推出 GPT-Live(continuous voice interaction with GPT-Live) —— 实时语音 AI 推理系统,通过"无轮次语音模型 + 低延迟架构"实现与 AI 的持续语音交互(openai.com/index/continuous-voice-interaction-with-gpt-live)—— 打破 v35 §2.144 "8-3 早晨 5 家 frontier lab 全静默"判断 = frontier lab 8-4 早晨实际有 2 件 net-new URL 公告 - 核心 net-new #2:Circles 利用 OpenAI 技术为电信运营商提供个性化服务 —— Circles(电信运营商)使用 OpenAI API + Codex 驱动 AI 原生电信体验,ARPU 提升 22% / 流失率降低 9% / 开发效率提升(openai.com/index/circles)—— 这是 OpenAI 与电信行业深度合作的"AI 原生 SaaS 渗透"案例 - 5 实例 RSS 净增量全表(8-4 vs 8-3): - OpenAI 5 → 5(+2 net-new / 0 重叠 / 0 旧出)= 净 +2 - Anthropic 5 → 5(+1 / -1 / 0 重叠)= 净 0(Economic Futures Research Fund agenda 入 / Cognizant 扩合作 出) - DeepMind 5 → 5(纯文案改写)= 净 0 - Google AI 5 → 5(纯文案改写)= 净 0 - HF Blog 5 → 5(纯文案改写)= 净 0 - Ben's Bites 5 → 5(纯文案改写)= 净 0 - TLDR AI 5 → 5(+1 / -1 / 4 重叠)= 净 0(8-3 早晨邮件《DeepSeek V4 Flash / OpenAI 数学 / Qwen 3.8-Max》入 / 7-27 Claude Opus 5 / NVIDIA 开源权重 出) - YT OpenAI 5 → 5(纯文案改写)= 净 0 - YT Anthropic 5 → 5(纯文案改写)= 净 0 - YT DeepMind 5 → 5(纯文案改写)= 净 0 - 结论:v35 §2.144 "5 家全静默"判断需要 v36 修正 —— 8-4 早晨 OpenAI 公告 2 件 net-new URL(虽然 Anthropic 替换 1 件 = 净 0,其余 4 家纯文案改写 = 净 0),整体净增 = +2 件 URL
与活文档现有脉络的关系: - v35 §2.144 OpenAI 8-2 早上 5 件(数学十项 + abundant intelligence + 欧洲合规 + Univé + 捣毁柬埔寨诈骗)(沿用)—— GPT-Live 与 Circles 为 v36 §2.144 OpenAI 修订候选新增 2 子目 - v35 §2.142 frontier lab × 监管 × 国际协作 三栖对位 第 1 例(沿用)—— 本期 OpenAI 8-4 早晨 2 件 net-new = frontier lab 公告从 v35 "5 家全静默" 反弹为 v36 "OpenAI 1 家 2 件 net-new" —— 立标饱和度 +1 - v35 §2.146 EU AI Act 2026-08-02 当日已过(沿用)—— GPT-Live + Circles 不在 EU AI Act 主轴,但 Circles 电信级 ARPU 22% / 流失率 9% = 欧洲合规下的商业化样板
建议归入: v36 §2.144 OpenAI 8-4 早上新增 2 子目(GPT-Live 实时语音 = 第 6 子目 / Circles 电信运营商 AI 原生 = 第 7 子目)+ v36 §2.142 frontier lab 公告反弹修订候选(v35 "5 家全静默" → v36 "OpenAI 1 家 2 件 net-new")+ v36 §3.1 共识新增(OpenAI GPT-Live 实时语音 = 8-4 frontier lab 公告净增量第 1 例)+ v36 §6.1 URL 列表 +2(continuous-voice-interaction-with-gpt-live + circles)。本期新增 arXiv 号 = 0 件(均为商业公告级)。
增量 2 · 🟡 HF Daily 8-4 票榜 = 15 件含 4 件 net-new(SAF-OPD 2607.29209 + Mental World Modeling 2607.27201 + AISPA 2607.28617 + RefCaptioner 2607.28509)+ 1 件下榜(DistillAlign 2607.26811)= 飞轮机制从"完全饱和"微反弹为"轮换态"
来源:
- inbox/tom/2026-08-04-0900-hf-daily-2026-08-04.md(HF Daily 8-4 票榜 15 件)
- 间接对比 inbox/tom/2026-08-03-0900-hf-daily-2026-08-03.md(8-3 票榜 15 件)
要点(8-4 vs 8-3 跨日变化): - 8-4 票榜 15 件 vs 8-3 票榜 15 件 跨日"4 件 net-new + 1 件下榜 + 10 件续立": - 4 件 net-new 入榜(8-4 早晨新上票榜): - #2 From RLVR to RLSVR arXiv:2607.23802 · 73▲(8-3 不在 top 15) - #3 Mental World Modeling arXiv:2607.27201 · 53▲(8-3 不在 top 15) - #10 AISPA arXiv:2607.28617 · 31▲(8-3 不在 top 15) - #12 RefCaptioner arXiv:2607.28509 · 26▲(8-3 不在 top 15) - 1 件下榜(8-3 在榜 / 8-4 不在 top 15): - DistillAlign arXiv:2607.26811 · 8-3 89▲ → 8-4 下榜(其他 14 件 8-3 票数 31~284 + 跨日 +0~+10) - 10 件续立(8-3 在榜 / 8-4 仍在榜): - #1 Qwen-UI-Agent 2607.28227 · 294▲(跨日 +10) - #4 Memory Decoder at Scale 2607.27919 · 51▲(跨日 +2) - #5 N_0-VTLA 2607.23782 · 50▲(本期新续立) - #6 Beacon 2607.28595 · 48▲(持平) - #7 Meshy T2 2607.28675 · 41▲(本期新续立) - #8 MPIE-Bench 2607.27616 · 37▲(持平) - #9 Beyond Borrowed Histories 2607.27816 · 32▲(跨日 +1) - #11 CLBench-V?(本期未查,沿用 v35 §2.143 第 11 位 = CLBench-V 2607.25294 · 44▲,但 8-4 票榜中未见,可能下榜) - #13 N_0-TWAM 2607.23783 · 28▲(本期新续立) - #14 QQWorld 2607.28415 · 24▲(本期新续立) - #15 SAF-OPD 2607.29209 · 23▲(本期新续立)
与活文档现有脉络的关系: - v35 §2.143 HF Daily 8-3 票榜 15 件全核 + 跨日 +1~+7 续立 = 飞轮机制衰减为稳态续立 第 1 例(沿用)—— 8-4 票榜出现"4 件 net-new 入榜 + 1 件下榜 + 10 件续立" = 飞轮机制从 v35 "完全饱和" 微反弹为 v36 "轮换态" - v35 §2.149 Memory Provenance Laundering arXiv:2607.29167 候补级立标(沿用)—— Mental World Modeling arXiv:2607.27201 在 8-4 票榜 #3 53▲ = 本论文既不在 v33 §2.143 增量 24 件内(虽然 arXiv 编号已在 v33 §2.143 列表中),但 8-3 ~ 8-4 早晨才被推上 HF Daily 票榜 #3 = 立标信号在 v36 早晨终于显化 - v35 §2.152 8-3 早晨 5 实例 RSS 大规模重抓 8-2 frontier lab 公告 = re-translation 净增量 0(沿用)—— 8-4 早晨 5 实例 RSS 净增 2 件 URL(OpenAI GPT-Live + Circles)= v36 §2.152 修订候选(从"完全饱和"修正为"OpenAI 1 家 +2")
建议归入: v36 §2.143 HF Daily 8-4 票榜新增 15 件(其中 4 件 net-new + 10 件续立 + 1 件下榜)+ v36 §3.2 争议候补(飞轮机制从 v35 "完全饱和" 微反弹为 v36 "轮换态" = 是否持续到 8-5 ~ 8-9?)+ v36 §4.1 开放问题候补(Mental World Modeling arXiv:2607.27201 8-4 #3 53▲ 是 v33 §2.143 已立标的论文,8-4 票榜终于追认 = v36 候补级新增候选级)。本期新增 arXiv 号 = 4 件 net-new 入榜(2607.23802 + 2607.27201 + 2607.28617 + 2607.28509)+ 10 件续立 + 1 件下榜 = 14 件变化 / 总计 15 件在榜。
增量 3 · 🟡 Mental World Modeling arXiv:2607.27201 8-4 HF Daily #3 53▲ = 世界模型范式"心理化"第 4 联立 = v33 已立标的论文在 v36 早晨正式升档
来源:
- inbox/flyp/2026-08-04-0950-Mental-World-Modeling-critical-read.md(flyp 8-4 0950 MWM 精读)
- inbox/flyp/2026-08-04-multimodal-e1prep.md §6 新立候选 ⑥(MWM = v40 §2.39.119 候补级新增)
- inbox/tom/2026-08-04-0900-hf-daily-2026-08-04.md #3 53▲(HF Daily 8-4 票榜)
- work-queue.md 8-4 10:00 §1 Top 15 高价值 deep read 第 2 件(★ ★ 0.5 优先级)
- paper_cards/706-2607-27201.md(8-4 02:10 新建卡 · 主分类 agent · 形态 method)
要点: - MWM(Mental World Modeling)核心命题:世界模型自 LeCun 2022 / Ha 2018 以来第一次明确把"心理状态"作为一等公民纳入 —— 形式化为 ⟨s_p, s_m⟩ 元组,物理状态是"全图",心理状态是"每个智能体的局部信念/意图/感受",两者耦合但可发散;目标特定的部分观察类似游戏"战争迷雾"的第一人称渲染 - MWM 既是 ai-industry 也是 multimodal / agent / world-model 主题:作者 Hao Fei / Yiran Zhao(新加坡国立大学 NExT++)投向 cs.CL,理论框架 + 实证基线双重定位,落地形式是 LLM-as-orchestrator 的训练自由系统 MENTIS - 8-4 HF Daily #3 53▲ 立标信号显著上升:arXiv 编号 2607.27201 在 v33 §2.143 增量 24 件 arXiv 列表中,但 v33 ~ v35 期间未入 HF Daily 票榜;8-3 ~ 8-4 早晨才被推上票榜 #3 = v36 早晨升档 - work-queue 8-4 §1 Top 15 #2 双信号叠加:HF Daily 高票 + work-queue 高优先级 = v36 §2 折 1.2 世界模型范式 候补级升档第 4 联"心理化" + flyp v40 §2.39.119 候补级新增候选 - 关键诊断(可信度 ★★★★ 理论新颖性 / ★★ 实证可验证性 / ★★ 可复现性 / ★★★★ 影响力潜力): - 统一理论框架:把"物理 + 心理"作为耦合状态空间,这是世界模型自 LeCun 2022 / Ha 2018 以来第一次明确把"心理状态"作为一等公民纳入 - 目标特定部分观察:类似"战争迷雾"的第一人称渲染,为多智能体场景中的"信息不对称"建模提供形式化基础 - MENTIS 训练自由基线:不需要训练就可检视,这是把"理论框架"和"可实现性"绑定的关键动作 - 关键风险(可信度 ★★): - MENTIS 是"训练自由"的代价:底座 LLM 性能锁定(GPT-4 / Claude 级别);论文未披露底座选择与 prompting 细节 - "心理状态可观测性"未给独立验证通道:与 LLM-as-judge 循环依赖风险同源 - 与心智理论(ToM)30+ 年研究的关系没说清:定位新颖性可被怀疑为"用 ToM 重新包装 world models" - 代码 / 数据未在 paper_card 来源 / TLDR 中给出:复现性弱
与活文档现有脉络的关系: - v35 §2.143 HF Daily 8-3 票榜 15 件(沿用)—— Mental World Modeling 8-4 #3 53▲ = v35 §2.143 候补级升档候选 - v35 §1 折 1.2 世界模型范式(沿用)—— MWM = v36 §1 折 1.2 第 4 联"心理化"(物理 / 阴影 / 代码 / 心理 四联 = PhiZero 156▲ + ShadowDancer + VisualPatchWorld + MWM) - v35 §2.149 Memory Provenance Laundering 候补级立标(沿用)—— MWM 与 Memory Provenance Laundering 同属 8-3 evening 棒前 12h 出现的候补级立标候选,MWM 8-4 HF Daily #3 = 立标信号更显著 - flyp 8-4 0950 MWM critical-read §2.3 与 v37 §1 折 1.2 世界模型范式(物理 / 阴影 / 代码 / 心理 四联)深度对齐
建议归入: v36 §1 折 1.2 世界模型范式子集新增"Mental World Modeling = 心理化锚"第 4 联(物理 PhiZero + 阴影 ShadowDancer + 代码 VisualPatchWorld + 心理 MWM)+ v36 §2.143 HF Daily 8-4 票榜 #3 53▲ 修订候选+ v36 §3.2 争议候补(MWM "理论锚" vs "实证锚" 边界 = 与 ToM 30+ 年研究的关系待 8-5 ~ 8-9 验证)+ v36 §4.1 开放问题候补(8-4 ~ 8-9 是否出 GitHub release / 顶会接收信号 / 至少 1 个独立实验室复现)+ v36 §6.1 URL +1(arxiv.org/abs/2607.27201 + mental-world.github.io 项目站)。本期新增 arXiv 号 = 1 件 net-new 入榜 arXiv:2607.27201 Mental World Modeling。
增量 4 · 🟡 tom 8-4 0840 radar 8 候选 4 高价值 = 1 件 net-new SAF-OPD + 3 件 8-3 沿用 = radar 候选池饱和度从 100% 降为 87.5%(松动)
来源:
- inbox/tom/2026-08-04T0840-agent-rag-longcontext-radar.md(8-4 radar 4 高价值 + 4 候选)
- 间接对比 inbox/tom/2026-08-03T0840-agent-rag-longcontext-radar.md(8-3 radar 8 候选 4 高价值 + 4 候选)
要点(tom 8-4 radar 4 高价值): - #1 HyPE arXiv:2607.29402 · 2026-07-31(tom 8-4 0840 radar + tom 8-4 0911 rag-lite + tom 8-4 0852 rag-e1prep + paper_cards/694 已建 + flyp v40 §2.40.x 待定 + rag 主题 P0 候补级新增)—— 本期沿用 v35 = 8-3 radar 已入候选 - #2 EMBL AI Librarian arXiv:2607.28229 · 2026-07-30(tom 8-4 0840 radar + paper_cards 未建 + rag 主题 P0 候补级新增)—— 本期沿用 v35 = 8-3 radar 已入候选 - #3 CrossRAG arXiv:2607.29459 · 2026-07-31(tom 8-4 0840 radar + tom 8-4 0852 rag-e1prep + paper_cards/693 已建 + flyp v40 §2.40.x 待定 + rag 主题 P0 候补级新增)—— 本期沿用 v35 = 8-3 radar 已入候选 - #4 SAF-OPD arXiv:2607.29209 · 2026-07-30 · 23 votes HF Daily 8-4 #15(tom 8-4 0840 radar #4 + tom 8-4 0852 rag-e1prep + tom 8-4 0911 rag-lite + paper_cards/701 已建 + work-queue 8-4 §1 Top 15 高价值 deep read 第 1 件 + HF Daily 8-4 #15 23▲)—— 本期 net-new = v36 §2 折 3 RL 训练 / RLVR 主线候补级新增候选
要点(tom 8-4 radar 4 候选 = 沿用件): - #5 Constitutional Midtraining arXiv:2607.26654(沿用 v35 = 8-3 radar 已入候选)+ #6 TFGformer arXiv:2607.29459(沿用,与 #3 CrossRAG 同 ID = CrossRAG/TFGformer 同篇)+ #7 RL²-VLA arXiv:2607.26991(沿用,work-queue 8-4 §1 Top 15 第 5 件)+ #8 Counterfactual Sensitivity Credit Reallocation arXiv:2607.27888(沿用,work-queue 8-4 §1 Top 15 第 4 件)
要点(8-4 radar 候选池饱和度): - 8-4 radar 8 候选中 7 件 8-3 已入候选(沿用)+ 1 件 net-new(SAF-OPD 2607.29209)= radar 候选池饱和度 = 7/8 = 87.5%(从 v35 §2.143 radar 100% 饱和降为 87.5% 松动) - SAF-OPD 立标信号:work-queue 8-4 §1 Top 15 第 1 件 + HF Daily 8-4 #15 23▲(刚刚入榜下限)= 立标上限约候补级低-中档 - SAF-OPD 核心:RLVR(单一 response 级 reward)和 OPD(token 级密集优势)互补,但直接融合会导致 entropy collapse,根源是 magnitude mismatch 和 temporal mismatch,SAF 提出稳定融合方案
与活文档现有脉络的关系: - v35 §2.143 HF Daily 8-3 票榜 15 件全核(沿用)—— 8-4 SAF-OPD 23▲ 刚刚入榜下限 = v35 §2.143 候补级升档候选 - v35 §2.143 §2.148 tom 8-3 radar 三班 4 高价值全部 v34 沿用(沿用)—— 8-4 radar 4 高价值中 3 件 v35 沿用 + 1 件 net-new = radar 候选池饱和度松动 - v35 §3.2 争议候补(radar 候选池饱和度 100% 达成需等 8-8 ~ 8-15 新一轮 arXiv 提交)—— 8-4 SAF-OPD 入候选 = radar 候选池饱和度 100% → 87.5% 松动,v36 §3.2 修订候选
建议归入: v36 §2.143 HF Daily 8-4 票榜新增 SAF-OPD #15 23▲ + v36 §3.2 争议候补(radar 候选池饱和度 100% → 87.5% 松动 = SAF-OPD 入榜第 1 例)+ v36 §4.1 开放问题候补(8-4 ~ 8-9 是否持续出现新 arXiv 入 radar = 立标饱和速度反弹)+ v36 §6.1 URL +1(arxiv.org/abs/2607.29209 SAF-OPD)。本期新增 arXiv 号 = 1 件 net-new 入 radar + 7 件 8-3 沿用 = 8 件总计。
增量 5 · 🟡 paper_cards 库 8-3 evening → 8-4 早晨 12h 净增 17 张(689 → 706)= card 库新增速率从 0.09 张/h 反弹为 1.42 张/h(15.8× 加速)
来源:
- inbox/flyp/2026-08-04-multimodal-e1prep.md §8(v39 §2.39.x 18 件候补级 paper_card 补建状态表)
- work-queue.md 8-4 10:00 §1 Top 15 高价值 6 件提示
- paper_cards/689-706 17 张新卡 8-3 14:10 + 8-4 02:10 / 03:00 全部新建
要点(paper_cards 库 8-3 evening 22:00 → 8-4 早晨 10:20 = 12h 窗口净增 17 张): - 8-3 14:10(8-3 evening 棒前 8h)新增 3 张: - 689 arXiv:1809.08267 Neural Approaches to Conversational AI(沿用 v35 §2.153) - 690 arXiv:2607.29007 EasyBCI Agent · 脑机接口预处理(v36 不立 ai-industry 候补级) - 691 arXiv:2607.29167 Memory Provenance Laundering(沿用 v35 §2.149,主分类 agent) - 692 arXiv:2607.29610 Educating the Agentic Engineer(v36 不立 ai-industry 候补级) - 8-4 02:10 / 03:00(8-3 evening 棒后 4h ~ 10h)新增 14 张: - 693 arXiv:2607.29459 TFGformer · 时频图学习 + 协变量融合(主分类 rag) - 694 arXiv:2607.29402 HyPE · 假设提示嵌入(主分类 rag) - 695 arXiv:2607.29679 Scaling Properties of Text Conditioning in Visual Generation(主分类 multimodal · v40 §2.39.114 候补级新增候选) - 696 arXiv:2607.29677 ExtractBench · 企业文档抽取(主分类 evaluation) - 697 arXiv:2607.29025 Evaluation-Verification Reward for Consistent Multi-Reference Image Editing(主分类 evaluation · 副 multimodal · v40 §2.39.115 候补级新增候选) - 698 arXiv:2607.28415 QQWorld · 世界模型正则化(主分类 agent) - 699 arXiv:2607.28675 Meshy T2 · 流匹配网格生成(主分类 llm-infra) - 700 arXiv:2607.18082 Rubric-based RL Self-Distillation(主分类 llm-infra) - 701 arXiv:2607.29209 SAF-OPD · On-Policy 蒸馏稳定优势融合(主分类 llm-infra · work-queue §1 Top 15 第 1 件) - 702 arXiv:2607.29684 Toward Robust and 3D-Aware RGB-NIR Imaging in the Dark(主分类 multimodal · work-queue §1 Top 15 第 6 件 · v40 §2.39.116 候补级新增候选) - 703 arXiv:2607.26991 RL²-VLA Test-Time Scaling for VLA(主分类 multimodal · work-queue §1 Top 15 第 5 件 · v40 §2.39.117 候补级新增候选) - 704 arXiv:2607.27888 Counterfactual Sensitivity Credit Reallocation for Long-CoT Reasoning(主分类 multimodal · work-queue §1 Top 15 第 4 件 · v40 §2.39.118 候补级新增候选) - 705 arXiv:2607.26611 Fewer Clarifications, Better Code · 跨会话个性化歧义自适应(主分类 evaluation · work-queue §1 Top 15 第 3 件) - 706 arXiv:2607.27201 Mental World Modeling(主分类 agent · work-queue §1 Top 15 第 2 件 + HF Daily 8-4 #3 53▲ · v40 §2.39.119 候补级新增候选)
与活文档现有脉络的关系: - v35 §2.153 paper_cards 库 8-3 09:00 新增 1 张 = 690 张累计(沿用)—— 8-3 evening 棒后 12h 窗口净增 17 张 = 706 张累计,新增速率从 v35 11h 净增 1 张 ≈ 0.09 张/h 反弹为 v36 12h 净增 17 张 ≈ 1.42 张/h,15.8× 加速 - v35 §2.153 待补 25 件 8-2 缺口仍未补建(沿用)—— 8-3 evening 棒后 12h 窗口 cron 卡建脚本触发 17 张 = 25 件缺口 + 17 张 net-new = 42 件待补,缺口仍未消化 - v35 §6.1 引用层修订候选(承接 v34 引用层)+ v36 §6.1 引用层修订候选 +5 ~ +8 件(695 / 697 / 702 / 703 / 704 / 706 + 沿用 691 + 694 + 693 + 701)
建议归入: v36 §2.153 paper_cards 库 706 张累计修订候选(8-3 evening 棒后 12h 净增 17 张 = 1.42 张/h 15.8× 加速)+ v36 §4.1 开放问题候补(cron 卡建脚本 12h 触发 17 张是 8-3 evening 警示"15 件必须补" + 17 件 net-new 共 42 件待补仍未消化)+ v36 §6.1 引用层修订候选 +5 ~ +8 件。本期新增 arXiv 号 = 17 件 net-new 入 card 库(其中 5 件 v40 候补级新增候选 + 12 件沿用 / 邻接)。
增量 6 · 🟢 8-4 X-VIP radar 10 账号 3 件 net-new(Karpathy Opus 5《指环王》+ Jim Fan Berkeley Summit + Ethan Mollick 驳创造力病毒帖)+ 7 件 7-26~8-2 旧闻重排 = 评论层 net-new 渐显
来源:
- inbox/stephen/2026-08-04-0910-news-x-vip-radar.md(8-4 0910 10 账号 X 雷达 10 件)
- 间接对比 inbox/stephen/2026-08-03-0910-news-x-vip-radar.md(8-3 0910 12 账号 X 雷达 12 件)
要点(8-4 X-VIP radar 10 件 = 3 件 net-new + 7 件 7-26~8-2 旧闻重排): - 🆕 8-4 0910 3 件 net-new(8-3 22:00 evening 棒后 12h 窗口内出现): - Karpathy Opus 5《指环王》"Pelican Test 2.0"(@karpathy · 2026-08-02 · 1M token 预算 + 两小时生成 5500 行 three.js 程序化动画 + "Pelican Test" 之后的新一代 LLM 创意评估范式)—— 评论层 8-2 ~ 8-3 evening 棒后首个 net-new 信号 - Jim Fan Berkeley Agentic AI Summit 2026(@DrJimFan · 2026-07-29 · Robotics & World Models 分论坛主讲"NVIDIA 机器人总监/杰出科学家"身份 + "机器人在物理世界行动前先推理"主题 · 议程贴由 @dawnsongtweets 发布)—— 评论层 7-29 ~ 8-3 evening 棒后首个 net-new 信号,但实际议程早于 8-3 - Ethan Mollick 驳 ChatGPT 30 天降低创造力病毒帖(@emollick · 2026-08-03 · 转述;未核验原帖)—— 评论层 8-3 net-new 信号 - 🔁 8-4 0910 7 件沿用(7-26~8-2 旧闻重排): - Sam Altman vs Musk OpenAI 窃密案(@sama · 2026-08-01 · 沿用 = 旧闻延后发布) - Andrew Ng Jensen Huang 联署信(@AndrewYNg · 2026-07-28 · 沿用) - Google DeepMind Gemini Robotics 2 / Robotics ER 2 / On-Device 2 三件套(@GoogleDeepMind · 2026-07-30 · 沿用 v35 §2.144) - Anthropic 3 起网络安全评估事件(@AnthropicAI · 2026-07-30 · 沿用 v35 §2.146) - OpenAI GPT-5.6 Fast mode + Academic Researchers(@OpenAI · 2026-07-30 · 沿用 v35 §2.144) - Yann LeCun AMI Labs 世界模型路线辩护(@ylecun · 2026-08 上旬 · 沿用) - HF 公开 OpenAI 关联"AI agent 自主网络攻击"事件技术时间线(@huggingface · 2026-08-03 · 转述博文;未抓到官方原帖链接 · 沿用 v35 §2.147)
与活文档现有脉络的关系: - v35 §2.108 X radar 7 件 + Karpathy 7-26 辟谣 + LeRobotHF 7-24 lerobot-annotate(沿用)—— 8-4 0910 3 件 net-new 为 7-29 ~ 8-3 评论层渐显信号 - v35 §2.137 修订候选 HF Grabette 7 月底 = physical AI 数据稀缺 7-月突破(沿用)—— Jim Fan Berkeley Summit "机器人在物理世界行动前先推理" 主题 与 HF Grabette / MWM 同属 physical AI + world model 主题群 - v35 §2.108 Karpathy 7-26 辟谣「离开 Anthropic」(沿用)—— Karpathy 8-2 Opus 5《指环王》"Pelican Test 2.0" = v36 §2.108 修订候选(Karpathy 创意评估范式从 Pelican Test → Pelican Test 2.0)
建议归入: v36 §2.108 X radar 修订候选新增 3 件(Karpathy Opus 5《指环王》"Pelican Test 2.0" + Jim Fan Berkeley Summit + Ethan Mollick 驳 ChatGPT 创造力病毒帖)+ v36 §4.1 开放问题候补(Karpathy Opus 5《指环王》"Pelican Test 2.0" = 评论层 8-2 net-new 第 1 例,但 Karpathy 项目站是否发布完整 5500 行 three.js 代码待 8-4 ~ 8-9 核验)+ v36 §3.2 争议候补(8-4 X-VIP radar 10 件中 7 件仍为 7-26~8-2 旧闻重排 = 评论层 12h 窗口净增 3 件 = 评论层也进入"饱和"状态)。本期新增 arXiv 号 = 0 件(均为评论 / 博客层)。
二、值得警惕的矛盾或待核实说法
矛盾 1 · 8-4 早晨 OpenAI news 净增 2 件 URL(GPT-Live + Circles)vs v35 §2.144 "5 家 frontier lab 8-3 早晨全静默" = 飞轮机制反例第 1 例
矛盾点: v35 §2.144 + §2.152 + stephen 8-3 1020 ai-industry-e1prep §矛盾 1 = "8-3 早晨 frontier lab 5 家全静默 vs 8-2 早晨 frontier lab 5 家同日集中发布 35 件 = 飞轮机制进入新阶段" —— 但 8-4 早晨 OpenAI news diff 检验后净增 2 件 URL(GPT-Live continuous voice interaction + Circles 电信运营商 AI 原生)= 实际 OpenAI 8-4 早晨有 2 件 net-new 公告(Anthropic 替换 1 件 net 0,DeepMind / Google AI / HF Blog / Ben's Bites 4 家纯文案改写 net 0)= frontier lab 公告从 v35 "5 家全静默" 反弹为 v36 "OpenAI 1 家 +2 件 URL"。
待核实: 1. OpenAI GPT-Live 是否在 8-4 ~ 8-5 之间公布技术细节(目前仅有 blog 公告,无 paper / GitHub) 2. OpenAI Circles 电信运营商 22% ARPU / 9% 流失率数据来源是否经第三方审计 3. OpenAI 8-4 早晨 2 件 net-new URL 是否是 OpenAI 8-2 早上 5 件的延续(数学十项 + abundant intelligence + 欧洲合规 + Univé + 捣毁柬埔寨诈骗)vs 全新 net-new 4. v35 §2.144 "5 家全静默" 判断是否需要 v36 §2.144 修订为 "OpenAI 1 家 +2 件 URL"(Anthropic 替换 1 件 + DeepMind / Google AI / HF Blog / Ben's Bites 4 家纯文案改写)
建议归入: §3.2 争议候补(OpenAI 8-4 早晨 +2 件 URL = frontier lab 公告反弹第 1 例,v35 "5 家全静默" → v36 "OpenAI 1 家 +2")· §4.1 开放问题候补(8-4 ~ 8-9 1 周窗口是否持续出现 frontier lab 公告反弹)。
矛盾 2 · HF Daily 8-4 票榜 4 件 net-new 入榜 vs v35 §2.143 "飞轮机制完全衰减" = 飞轮机制从"完全饱和"微反弹为"轮换态"
矛盾点: v35 §2.143 + stephen 8-3 1020 ai-industry-e1prep §矛盾 3 = "HF Daily 8-3 票榜 15 件全核 + 跨日 +1 ~ +7 续立 vs 8-2 早晨跨日翻倍级 257% 触飞轮 = 飞轮机制衰减 vs 跨日翻倍级" —— 但 8-4 票榜 15 件中 4 件 net-new 入榜(RLSVR 2607.23802 + Mental World Modeling 2607.27201 + AISPA 2607.28617 + RefCaptioner 2607.28509)+ 1 件下榜(DistillAlign 2607.26811)+ 10 件续立 = "飞轮机制从 v35 完全饱和" 微反弹为 v36 "轮换态"。
待核实: 1. 8-4 票榜 4 件 net-new 入榜(RLSVR 2607.23802 + MWM 2607.27201 + AISPA 2607.28617 + RefCaptioner 2607.28509)是否在 8-3 ~ 8-4 早晨 HF Daily index 重新排序后才被推上票榜 2. DistillAlign 2607.26811 8-4 下榜是因为跨日票数衰减 vs 被新候选挤出 top 15 3. 8-4 ~ 8-9 1 周窗口是否持续出现 HF Daily 票榜"轮换"(每日 3 ~ 5 件 net-new 入榜 + 1 ~ 3 件下榜)
建议归入: §3.2 争议候补(HF Daily 8-4 票榜"轮换态" = 飞轮机制从完全饱和微反弹 vs 一次性偶发事件?需观察 8-4 ~ 8-9 5 天窗口)· §4.1 开放问题候补(Mental World Modeling arXiv:2607.27201 8-4 #3 53▲ 是 v33 §2.143 已立标的论文 8-4 票榜才追认 = v36 候补级新增候选)。
矛盾 3 · Mental World Modeling arXiv:2607.27201 v33 §2.143 已立标 vs 8-4 HF Daily #3 53▲ 才追认 = 立标信号延迟 1 个月
矛盾点: v33 §2.143 增量 24 件 arXiv 列表中已含 arXiv:2607.27201 MWM,但 v33 ~ v35 期间 MWM 一直未入 HF Daily 票榜,8-3 ~ 8-4 早晨才被推上 #3 53▲ = arXiv 提交日期(2026-07-31)vs HF Daily 票榜追认日期(8-4)= 立标信号延迟约 4 天,但立标级别跃升 = 候补级 → 立标级(从 v33 arXiv 编号入册到 v36 HF Daily 高票追认)= v36 §2 折 1.2 世界模型范式"心理化"第 4 联候补级新增候选。
待核实: 1. MWM 8-4 HF Daily #3 53▲ 是否触发 v36 §2 折 1.2 世界模型范式"心理化"第 4 联候补级新增 2. MWM 与 ToM(Theory of Mind)30+ 年研究的关系是否在论文中明确(目前 flyp 8-4 0950 critical-read §4.2 #3 指出"未明确对比") 3. MENTIS 训练自由基线 + LLM-as-orchestrator 的底座选择(GPT-4 / Claude 级别)在 v2 / GitHub release 是否披露 4. 8-4 ~ 8-9 1 周窗口是否出 GitHub release / 顶会接收信号 / 至少 1 个独立实验室复现
建议归入: §3.2 争议候补(MWM "理论锚" vs "实证锚" 边界 + ToM 30+ 年研究的关系待 8-5 ~ 8-9 验证)· §4.1 开放问题候补(8-4 ~ 8-9 是否出 GitHub release / 顶会接收信号 / 至少 1 个独立实验室复现)。
矛盾 4 · paper_cards 库 8-3 evening 棒后 12h 净增 17 张 = 1.42 张/h vs v35 8-3 11h 净增 1 张 = 0.09 张/h = 卡片库新增速率 15.8× 加速
矛盾点: v35 §2.153 = "paper_cards 库 8-3 09:00 新增 1 张 = 690 张累计 + 卡片库新增速率 8-2 evening 22:45 → 8-3 09:00 = 11h 净增 1 张 = 0.09 张/h(接近稳态)+ 14 件 8-2 缺口仍未补建 + 8-3 evening 棒前必须 cron 卡建脚本跑齐 15 件" —— 但 8-3 evening 棒后 12h 窗口 cron 卡建脚本触发 17 张(689 → 706)= 新增速率 = 17 / 12 ≈ 1.42 张/h = 15.8× 加速。
待核实: 1. 8-3 evening 棒前 12h vs 后 12h 卡库新增速率差异 158× 的原因(是 cron 卡建脚本 8-3 evening 棒后触发 vs v35 evening 棒前卡库新增速率 0.09 张/h 是 cron 卡建脚本未触发) 2. 8-3 evening 棒后 12h 17 张 = v35 警示 14 件 8-2 缺口是否已全部消化 + 8-3 net-new 3 件(8-3 evening 棒前 8h 689 / 690 / 691 / 692 4 张 - v35 已立的 1 张 689 = 实际 3 张 net-new)= 14 件缺口 + 3 件 net-new = 17 张 = 8-3 evening 棒警示 15 件 已基本消化 3. 8-4 早晨 10:20 cron 卡建脚本是否持续触发(从 17 张 / 12h ≈ 1.42 张/h 速率是否会持续到 8-4 evening 棒)
建议归入: §4.1 开放问题候补(paper_cards 库新增速率从 v35 0.09 张/h 反弹为 v36 1.42 张/h,15.8× 加速 = cron 卡建脚本 8-3 evening 棒后触发 vs 持续速率是否维持)。
矛盾 5 · tom 8-4 0840 radar 4 高价值中 1 件 net-new SAF-OPD vs v35 §2.143 radar 候选池饱和度 100% = 候选池饱和度从 100% 降为 87.5% 松动
矛盾点: v35 §2.143 + stephen 8-3 1020 ai-industry-e1prep §矛盾 5 = "tom 8-3 radar 8 候选 4 高价值 = 全部 v34 沿用 = radar 候选池饱和度 100% 达成" —— 但 tom 8-4 0840 radar 8 候选中 7 件 8-3 已入候选(沿用)+ 1 件 net-new SAF-OPD arXiv:2607.29209 = radar 候选池饱和度 = 7/8 = 87.5%(松动 12.5%)。
待核实: 1. SAF-OPD 8-4 HF Daily #15 23▲(刚刚入榜下限)是否在 8-4 ~ 8-7 1 周窗口内升至 top 10(目前 23▲ 排名末位) 2. SAF-OPD RL 训练 / RLVR 主线候补级新增候选立标上限约候补级低-中档 3. 8-4 ~ 8-9 1 周窗口是否持续出现新 arXiv 入 radar = 立标饱和速度反弹
建议归入: §3.2 争议候补(radar 候选池饱和度 100% → 87.5% 松动 = SAF-OPD 入候选第 1 例,是否持续到 8-4 ~ 8-9 5 天窗口)· §4.1 开放问题候补(8-4 ~ 8-9 是否持续出现新 arXiv 入 radar)。
矛盾 6 · spark 8-4 早晨 3 RSS 静默 vs 8-2 13:30 agent-v38 + 1848 llm-infra-v14 = 周期性轮换模式延续(连续第 2 天静默)
矛盾点: v35 §2.148 + stephen 8-3 1020 ai-industry-e1prep §矛盾 6 = "spark 8-3 周一 morning 静默 + 周期性轮换模式延续" —— 8-4 周二 morning spark 3 RSS(gradient-flow / chip-huyen / 3blue1brown)继续静默 = 连续第 2 天静默 = 周期性轮换模式延续第 2 例。
待核实: 1. spark 8-4 evening 棒前是否出 agent-e1prep-v39 + llm-infra-e1prep-v15 第 15 棒 2. 8-3 + 8-4 连续 2 天 morning 静默是否与 spark-on-Tom E3 review 警示"周期性轮换模式化塌方"一致 3. spark 8-4 evening 棒 vs 8-3 evening 棒之间是否出现"双静默 + 双棒"(即 evening 棒也推迟到 8-5)
建议归入: §4.1 开放问题候补(spark 8-4 周二 morning 静默 + 连续第 2 天静默 = 周期性轮换模式延续第 2 例 vs 8-4 ~ 8-9 1 周窗口其他实例轮换模式)。
三、可引用的 arXiv 号列表(本期新增 6 件 net-new + 10 件沿用 + 4 件 8-3 evening 棒前 8h 已建卡 = 共 20 件)
本期 net-new 入榜 / 入 radar / HF Daily 第 1 次(6 件)
| arXiv 号 | 标题(中文) | 来源 | 本期状态 |
|---|---|---|---|
| arXiv:2607.23802 | From RLVR to RLSVR:任务变换诱导开放域 LLM 自我提升的可自验证奖励 | tom 8-4 0900 HF Daily #2 73▲ + tom 8-4 0911 rag-lite #5 | 本期 net-new 入榜(HF Daily 8-4 #2 73▲ 立标上限约候补级低档,v36 §2.143 修订候选) |
| arXiv:2607.27201 | Mental World Modeling(MWM) | tom 8-4 0900 HF Daily #3 53▲ + work-queue 8-4 §1 Top 15 #2 + paper_cards/706 + flyp 8-4 0950 critical-read | 本期 net-new 入榜 + 立标升档(HF Daily 8-4 #3 53▲,v33 §2.143 已立标的论文 8-4 票榜追认,v36 §1 折 1.2 世界模型范式"心理化"第 4 联候补级新增) |
| arXiv:2607.28617 | AISPA:面向 LLM 应用的用户中心系统提示审计 | tom 8-4 0900 HF Daily #10 31▲ + paper_cards 未建 | 本期 net-new 入榜(HF Daily 8-4 #10 31▲,评测邻接,非 ai-industry 核心) |
| arXiv:2607.28509 | RefCaptioner:多参考图像锚定的视频字幕生成 | tom 8-4 0900 HF Daily #12 26▲ + paper_cards 未建 | 本期 net-new 入榜(HF Daily 8-4 #12 26▲,评测邻接) |
| arXiv:2607.29209 | SAF-OPD:面向 On-Policy 蒸馏的稳定优势融合 | tom 8-4 0840 radar #4 + tom 8-4 0911 rag-lite #5 + paper_cards/701 + work-queue 8-4 §1 Top 15 #1 + HF Daily 8-4 #15 23▲ | 本期 net-new 入 radar + HF Daily 末位(立标上限约候补级低-中档,v36 §2 折 3 RL 训练 / RLVR 主线候补级新增) |
| arXiv:2607.26611 | Fewer Clarifications, Better Code:跨会话个性化歧义自适应 | work-queue 8-4 §1 Top 15 #3 + paper_cards/705 | 本期 net-new 入 work-queue(立标上限约候补级低档,评测邻接) |
沿用 v35 §2.143 HF Daily 8-3 票榜 14 件 → 8-4 票榜 10 件续立 + 1 件下榜 + 3 件 8-3 不在榜但 8-4 续立(14 件 = 10 + 1 + 3)
| arXiv 号 | 标题(中文) | 8-4 票数 | 8-3 票数 | 跨日增量 |
|---|---|---|---|---|
| arXiv:2607.28227 | Qwen-UI-Agent | 294▲ | 284▲ | +10 |
| arXiv:2607.27919 | Memory Decoder at Scale | 51▲ | 49▲ | +2 |
| arXiv:2607.28595 | Beacon | 48▲ | 48▲ | 持平 |
| arXiv:2607.27616 | MPIE-Bench | 37▲ | 37▲ | 持平 |
| arXiv:2607.27816 | Beyond Borrowed Histories | 32▲ | 31▲ | +1 |
| arXiv:2607.26811 | DistillAlign | 下榜 | 89▲ | - |
| arXiv:2607.23782 | N_0-VTLA | 50▲ | 8-3 不在榜 | 续立 |
| arXiv:2607.28675 | Meshy T2 | 41▲ | 8-3 不在榜 | 续立 |
| arXiv:2607.23783 | N_0-TWAM | 28▲ | 8-3 不在榜 | 续立 |
| arXiv:2607.28415 | QQWorld | 24▲ | 8-3 不在榜 | 续立 |
8-3 evening 棒前 8h 已建 paper_card 4 件(8-3 14:10 新增)沿用 v35
| arXiv 号 | 标题(中文) | 状态 |
|---|---|---|
| arXiv:1809.08267 | Neural Approaches to Conversational AI(2018 旧文 / 752 引) | 8-3 14:10 新建卡 · 沿用 v35 §2.153 |
| arXiv:2607.29007 | EasyBCI Agent · 脑机接口预处理 | 8-3 14:10 新建卡 · 不立 ai-industry 候补级 |
| arXiv:2607.29167 | Memory Provenance Laundering | 8-3 14:10 新建卡 · 沿用 v35 §2.149 |
| arXiv:2607.29610 | Educating the Agentic Engineer | 8-3 14:10 新建卡 · 不立 ai-industry 候补级 |
8-4 02:10 / 03:00 新建 paper_card 11 件(沿用 flyp v40 §2.39.x 候补级新增候选)
| arXiv 号 | 标题(中文) | 状态 |
|---|---|---|
| arXiv:2607.29459 | TFGformer · 时频图学习 + 协变量融合 | 8-4 02:10 · 主分类 rag · flyp v40 §2.40.x 待定 |
| arXiv:2607.29402 | HyPE · 假设提示嵌入 | 8-4 02:10 · 主分类 rag · flyp v40 §2.40.x 待定 |
| arXiv:2607.29679 | Scaling Properties of Text Conditioning | 8-4 02:10 · 主 multimodal · flyp v40 §2.39.114 候补级新增 |
| arXiv:2607.29677 | ExtractBench · 企业文档抽取 | 8-4 02:10 · 主 evaluation · flyp 不立 multimodal |
| arXiv:2607.29025 | Evaluation-Verification Reward Multi-Reference Editing | 8-4 02:10 · 主 evaluation · flyp v40 §2.39.115 候补级新增 |
| arXiv:2607.28415 | QQWorld · 世界模型正则化 | 8-4 02:10 · 主 agent |
| arXiv:2607.28675 | Meshy T2 · 流匹配网格生成 | 8-4 02:10 · 主 llm-infra |
| arXiv:2607.18082 | Rubric-based RL Self-Distillation | 8-4 02:10 · 主 llm-infra |
| arXiv:2607.29209 | SAF-OPD · On-Policy 蒸馏稳定优势融合 | 8-4 03:00 · 主 llm-infra · work-queue §1 Top 15 #1 |
| arXiv:2607.29684 | Toward Robust and 3D-Aware RGB-NIR Imaging in the Dark | 8-4 02:10 · 主 multimodal · work-queue §1 Top 15 #6 · flyp v40 §2.39.116 |
| arXiv:2607.26991 | RL²-VLA Test-Time Scaling for VLA | 8-4 02:10 · 主 multimodal · work-queue §1 Top 15 #5 · flyp v40 §2.39.117 |
| arXiv:2607.27888 | Counterfactual Sensitivity Credit Reallocation for Long-CoT | 8-4 02:10 · 主 multimodal · work-queue §1 Top 15 #4 · flyp v40 §2.39.118 |
| arXiv:2607.26611 | Fewer Clarifications, Better Code · 跨会话个性化 | 8-4 02:10 · 主 evaluation · work-queue §1 Top 15 #3 |
| arXiv:2607.27201 | Mental World Modeling | 8-4 02:10 · 主 agent · work-queue §1 Top 15 #2 + HF Daily 8-4 #3 53▲ · flyp v40 §2.39.119 |
总计 24 件 arXiv(本期 net-new 6 件 + 沿用 v35 1 件 1809.08267 + 沿用 flyp v40 §2.39.x 11 件 + work-queue §1 Top 15 5 件 + Memory Provenance Laundering 沿用 1 件) = 24 件去重 = 沿用 v35 237 + 本期新增 6 件 = 约 243 件。
8-4 早晨 OpenAI 商业公告级 net-new URL(2 件,无 arXiv 编号)
- openai.com/index/continuous-voice-interaction-with-gpt-live(OpenAI GPT-Live 实时语音 AI 推理系统,8-4 net-new URL #1)
- openai.com/index/circles(OpenAI + Circles 电信运营商 AI 原生合作,ARPU 提升 22%,8-4 net-new URL #2)
8-4 早晨 Anthropic 商业公告级 替换 URL(1 件替换 1 件,净 0)
- 入:Anthropic 经济未来研究基金的研究议程(8-4 入 / 8-3 不在)
- 出:Anthropic 扩大与 Cognizant 的合作(8-3 在 / 8-4 出)
8-4 早晨 TLDR AI 8-3 邮件标题(1 件入 + 1 件出,净 0)
- 入:DeepSeek V4 Flash ⚡,OpenAI 数学突破 🔢,Qwen 3.8-Max 🤖(tldr.tech/ai/2026-08-03)
- 出:Claude Opus 5 🧠,OpenAI 黑客事件内幕 👨💻,NVIDIA 开源权重 🔓(tldr.tech/ai/2026-07-27)
四、本期检查过的来源
inbox/stephen/ 8-4 早晨 11 件(全查 + diff 检验)
- 2026-08-04-0910-news-x-vip-radar.md · 10 账号 X 雷达 10 件(已在增量 6 详述 · 3 件 net-new + 7 件 7-26~8-2 旧闻重排)
- 2026-08-04-1004-news-openai-news.md · OpenAI 5 件(diff vs 8-3 后净增 2 件 URL:GPT-Live + Circles,已在增量 1 详述)
- 2026-08-04-1004-news-anthropic-news.md · Anthropic 5 件(diff vs 8-3 后替换 1 件:Economic Futures Research Fund agenda 入 / Cognizant 出,净 0)
- 2026-08-04-1005-news-deepmind-news.md · DeepMind 5 件(diff vs 8-3 后纯文案改写,0 件净增)
- 2026-08-04-1005-news-google-ai.md · Google AI 5 件(diff vs 8-3 后纯文案改写,0 件净增)
- 2026-08-04-1005-news-hf-blog.md · HF Blog 5 件(diff vs 8-3 后纯文案改写,0 件净增)
- 2026-08-04-1005-news-tldr-ai.md · TLDR AI 5 件(diff vs 8-3 后净增 1 件:8-3 邮件《DeepSeek V4 Flash / OpenAI 数学 / Qwen 3.8-Max》入 / 7-27 Claude Opus 5 + NVIDIA 出,净 0)
- 2026-08-04-1005-news-bens-bites.md · Ben's Bites 5 件(diff vs 8-3 后纯文案改写,0 件净增)
- 2026-08-04-1007-news-yt-openai.md · OpenAI YT 5 件(diff vs 8-3 后纯文案改写,0 件净增)
- 2026-08-04-1007-news-yt-anthropic.md · Anthropic YT 5 件(diff vs 8-3 后纯文案改写,0 件净增)
- 2026-08-04-1007-news-yt-deepmind.md · DeepMind YT 5 件(diff vs 8-3 后纯文案改写,0 件净增)
inbox/tom/ 8-4 早晨 5 件(全查)
- 2026-08-04-0900-hf-daily-2026-08-04.md · HF Daily 8-4 票榜 15 件 = 本期最重要的 1 件(已在增量 2 详述 · 4 件 net-new + 1 件下榜 + 10 件续立)
- 2026-08-04T0840-agent-rag-longcontext-radar.md · 8-4 radar 8 候选 4 高价值 + 4 候选(已在增量 4 详述 · 1 件 net-new SAF-OPD + 7 件 8-3 沿用 = 候选池饱和度 100% → 87.5%)
- 2026-08-04-1006-rss-yt-lex-fridman.md · Lex Fridman 5 件(全部 7-29 ~ 8-3 历史访谈沿用,ai-industry 主题 0 件)
- 2026-08-04-1006-rss-yt-yannic-kilcher.md · Yannic Kilcher 5 件(全部 7-29 ~ 8-3 历史直播沿用,ai-industry 主题 0 件 · TiDAR + Titans 论文解读为推理层非 ai-industry)
- 2026-08-04-rag-e1prep.md · tom 8-4 0852 rag-e1prep(已在增量 4 引用 · HyPE + CrossRAG + EMBL AI Librarian + SAF-OPD 等)
- 2026-08-04_rag-lite.md · tom 8-4 0911 rag-lite 8 件(已在增量 4 引用)
inbox/jay/ 8-4 早晨 12 件(全查)
- 2026-08-04-1000-rss-raschka.md · Raschka 5 件(全部 7-25 ~ 8-1 旧文沿用,0 件 net-new)
- 2026-08-04-1001-rss-bytebytego.md · ByteByteGo 5 件(全部 7-29 ~ 8-3 旧文沿用,0 件 net-new)
- 2026-08-04-1001-rss-nathan-benaich.md · Nathan Benaich 5 件(全部 5-1 ~ 8-3 旧文沿用,0 件 net-new)
- 2026-08-04-1001-rss-simon-willison.md · Simon Willison 5 件(5 件 net-new 全为 8-2 ~ 8-4 早晨新文:Steve Yegge Gas Town + 肉代理 + David Crawshaw prompt + 开发工具必须开源 + condense-json 1.0 · ai-industry 主题间接相关)
- 2026-08-04-1002-rss-cool-papers.md · Cool Papers cs.CL 5 件(5 件 net-new:TokTier 2607.29678 + 频率结构化意义 2607.29642 + FriendBench 2607.29602 + ResKV 2607.29591 + 谄媚行为 2607.29585 · 主分类 cs.CL · 与 ai-industry 主题间接相关)
- 2026-08-04-1002-rss-cool-papers-ir.md · Cool Papers cs.IR 5 件(5 件 net-new:QASP 2607.29606 + HyPE 2607.29402 沿用 + LM 同质化 2607.29274 + RecHarness 2607.29241 + GALA 2607.29213 · 主分类 cs.IR · 与 ai-industry 主题间接相关)
- 2026-08-04-1002-rss-lilian-weng.md · Lilian Weng 5 件(全部 2024 ~ 2026 旧文沿用,0 件 net-new)
- 2026-08-04-1003-rss-msr-blog.md · MSR Blog 5 件(全部 7-30 ~ 8-3 旧文沿用 · Orchard 框架 + Echoverse + EvoLib + SymCrypt + Aurora 1.5)
- 2026-08-04-1004-rss-import-ai.md · Import AI 5 件(全部 7-22 ~ 8-3 旧文沿用 · Import AI 463-467)
- 2026-08-04-1005-rss-yt-karpathy.md · Karpathy YT 5 件(全部 2024 ~ 2026 旧视频沿用,0 件 net-new)
- 2026-08-04-1007-rss-yt-fireship.md · Fireship YT 5 件(全部 7-31 ~ 8-3 旧视频沿用 · Anthropic 终结独立开发者 + 史上最有趣的 hack + 开源权重 2.8T + 估值 120 亿初创 + OpenAI 窃密)
- 2026-08-04-llm-inference-csdn-highvalue.md · 8-4 LLM 推理 csdn(vLLM 部署排坑 + KV Cache 显存公式 + 企业级 LLM 落地 6 大踩坑 + 框架选型 + SFT 微调 5 大踩坑 + 4 篇,ai-industry 主题直接增量 = 0 件)
- 2026-08-04T0940-jay-ai-engineering-trending-aug.md · jay 8-4 0940 AI 工程 trending(已在 §增量 5 引用 · GitHub Trending + HF Trending + Vector DB Q2 2026 + Substack 4 篇 · ai-industry 主题间接相关,Kimi K3 / OpenClaw / Qdrant 等)
inbox/flyp/ 8-4 早晨 6 件(全查)
- 2026-08-04-0950-Mental-World-Modeling-critical-read.md · flyp 8-4 0950 MWM 精读(已在增量 3 详述)
- 2026-08-04-1001-rss-cameron-wolfe.md · Cameron Wolfe 5 件(全部 7-27 ~ 8-3 旧文沿用 · Agentic World Models + Agentic RL + Agent 评估 + RL Scaling Laws + LLM Bench)
- 2026-08-04-1003-rss-interconnects.md · Interconnects 5 件(全部 7-26 ~ 8-2 旧文沿用 · Artifacts Hub + Laguna S2.1 + Kimi K3 + Open Models 6 个月 · 间接相关 Kimi K3 + Interconnects 论 open models 6 个月 = 8-4 早晨 Interconnects 旧闻再热)
- 2026-08-04-1006-rss-yt-ai-explained.md · AI Explained 5 件(全部 7-30 ~ 8-3 旧视频沿用 · GPT-6 失控 HF 事件 + 模型大爆炸 GPT 5.6 + Fable 5 vs GPT 5.6 + Claude Fable 被封 + Claude Fable 5 拆解)
- 2026-08-04-1006-rss-yt-two-minute-papers.md · Two Minute Papers 5 件(全部 7-30 ~ 8-3 旧视频沿用 · 又一个 DeepSeek 时刻 + NVIDIA AI 模仿人类不够 + Kimi K3 打破 AI 经济学 + Claude AI 最大问题 + Anthropic 不该存在的东西)
- 2026-08-04-multimodal-e1prep.md · flyp 8-4 0940 multimodal-e1prep(已在增量 3 引用 · 6 件 v40 §2.39.x 候补级新增候选)
inbox/spark/ 8-4 早晨 3 件(全查)
- 2026-08-04-1002-rss-gradient-flow.md · Gradient Flow 5 件(全部 7-30 ~ 8-3 旧文沿用 · 大模型实验室动摇云厂商 + AMD AI 押注 + 专用 AI 越来越易构建 + 大实验室与你的数据竞争 + 开源权重多维度 checklist)
- 2026-08-04-1003-rss-chip-huyen.md · Chip Huyen 5 件(全部 2024 ~ 2025 旧文沿用,0 件 net-new · AI 工程陷阱 + Agent + GenAI 平台 + 个人成长 + 900 个开源 AI 工具)
- 2026-08-04-1007-rss-yt-3blue1brown.md · 3Blue1Brown 5 件(全部数学科普短视频沿用,0 件 net-new)
- spark 8-4 morning 连续第 2 天静默 = 3 RSS 无 agent-e1prep / llm-infra-e1prep 棒 = 周期性轮换模式延续(已在 §矛盾 6 详述)
paper_cards/ 近 3 天新卡抽查(8-3 evening 棒后 12h 净增 17 张)
- 8-3 14:10 新增 4 张:689 1809.08267 Neural Approaches to Conversational AI / 690 2607.29007 EasyBCI Agent / 691 2607.29167 Memory Provenance Laundering / 692 2607.29610 Educating the Agentic Engineer
- 8-4 02:10 新增 13 张:693 2607.29459 TFGformer / 694 2607.29402 HyPE / 695 2607.29679 Scaling Properties / 696 2607.29677 ExtractBench / 697 2607.29025 Evaluation-Verification Reward / 698 2607.28415 QQWorld / 699 2607.28675 Meshy T2 / 700 2607.18082 Rubric-based RL / 702 2607.29684 3D-Aware RGB-NIR / 703 2607.26991 RL²-VLA / 704 2607.27888 Counterfactual Sensitivity / 705 2606.26611 Fewer Clarifications / 706 2607.27201 Mental World Modeling
- 8-4 03:00 新增 1 张:701 2607.29209 SAF-OPD
- 合计 8-3 evening 棒后 12h 净增 17 张(689 → 706)+ 卡片库新增速率从 v35 0.09 张/h 反弹为 v36 1.42 张/h = 15.8× 加速
work-queue.md 8-4 10:00 抽查
- 1) 高价值待深度解读 Top 15 / 共 6(vs v35 §2.153 1 件 1809.08267):
[0.5] 2607.29209 · SAF-OPD: Stable Advantage Fusion for On-Policy Distillation[0.5] 2607.27201 · Mental World Modeling[0.5] 2607.26611 · Fewer Clarifications, Better Code: Benchmarking Cross-Sessio[0.5] 2607.27888 · Not All Tokens Deserve Equal Credit: Counterfactual Sensitiv[0.5] 2607.26991 · RL^2-VLA: Adaptive RL Latent Compositional Steering with Tes[0.5] 2607.29684 · Toward Robust and 3D-Aware RGB-NIR Imaging in the Dark- 2) 待更新/缺失的主题活文档(0): 全部最新(8-4 morning 10:00 自动生成时确认)—— v35 evening 刚收官,所有活文档已就位
- 3) 选题榜未成视频脚本(1):
2607.24368— 与 8-3 10:00 沿用相同 - 4) 待写攻略 Top 15 / 共 15(vs v35 §2.153 2 件):
[周增 +1092 / Stars 3216] slvDev/esp32-ai(Tom 认领)[周增 +475 / Stars 3179] davidondrej/skills(Jay 认领)[周增 +154 / Stars 4200] IBM/mcp-context-forge(spark 认领)[周增 +0 / Stars 265606] obra/superpowers(Tom 认领)[周增 +0 / Stars 201144] mattpocock/skills(Jay 认领)[周增 +0 / Stars 199078] multica-ai/andrej-karpathy-skills(spark 认领)[周增 +0 / Stars 194964] ultraworkers/claw-code(Tom 认领)[周增 +0 / Stars 192802] anomalyco/opencode(Jay 认领)[周增 +0 / Stars 177685] ollama/ollama(spark 认领)[周增 +0 / Stars 163296] huggingface/transformers(Tom 认领)[周增 +0 / Stars 142537] x1xhlol/system-prompts-and-models-of-ai-tools(Jay 认领)[周增 +0 / Stars 140113] anthropics/claude-code(spark 认领)[周增 +0 / Stars 138334] msitarzewski/agency-agents(Tom 认领)[周增 +0 / Stars 122572] ggml-org/llama.cpp(Jay 认领)[周增 +0 / Stars 103608] openai/codex(spark 认领)- 5) 富化缺口:14 张卡缺 TLDR(待 cron_s2 覆盖) — 与 8-3 10:00 沿用相同
- 6) 待精确分类:0 张卡(主分类缺失或待LLM精修 · cron_classify_llm 低峰消化) — 与 8-3 10:00 沿用相同
五、本期判断与建议
主线增量:6 条 + 6 件 arXiv net-new(本期 6 件)+ 2 件商业 URL + 1 件替换 = 中密度
- 应承接 v35 evening 182 主线 + 152 共识 + 123 争议 + 228 开放问题 + 约 237 arXiv + 12 CVE + 约 258 URL = v36 接力棒 12h 窗口后,本期真正 ai-industry 主题 net-new 增量 = 6 件(OpenAI GPT-Live + Circles 商业 URL 2 件 + Mental World Modeling arXiv:2607.27201 + SAF-OPD arXiv:2607.29209 + HF Daily 8-4 票榜 RLSVR 2607.23802 + AISPA 2607.28617 + RefCaptioner 2607.28509 + Fewer Clarifications 2607.26611 6 件 arXiv = 6 件 net-new + 10 件沿用)+ 4 件 HF Daily 轮换(SAF-OPD / MWM / RLSVR / AISPA / RefCaptioner 入榜 + DistillAlign 下榜)+ 1 件 radar net-new(SAF-OPD)+ 3 件 X-VIP radar net-new(Karpathy Opus 5《指环王》+ Jim Fan Berkeley Summit + Ethan Mollick 驳创造力病毒帖)+ 1 件 paper_cards 库新增速率反弹 15.8× = 飞轮机制从 v35 "完全饱和" 微反弹为 v36 "轮换态" 第 1 例。
- v36 接力棒(今晚 22:00 evening 棒)预估:在 v35 182 主线 + 152 共识 + 123 争议 + 228 开放问题 + 约 237 arXiv 基础上,新增 2 ~ 4 主线密集(OpenAI GPT-Live 实时语音 + Circles 电信 = frontier lab 公告反弹 + Mental World Modeling = 世界模型心理化 + SAF-OPD = RL 训练 RLVR)+ 0 件 frontier lab 5 家全静默修订候选(OpenAI 1 家 +2 件 URL)+ 4 件 HF Daily 轮换修订候选+ 1 件 radar 候选池饱和度松动+ 1 件 paper_cards 库新增速率 15.8× 加速+ 6 条矛盾/待核实。
矛盾或待核实:6 条(候补进入 §3.2 / §4.1)
- 8-4 早晨 OpenAI news 净增 2 件 URL(GPT-Live + Circles)vs v35 §2.144 "5 家 frontier lab 8-3 早晨全静默" = 飞轮机制反例第 1 例
- HF Daily 8-4 票榜 4 件 net-new 入榜 vs v35 §2.143 "飞轮机制完全衰减" = 飞轮机制从"完全饱和"微反弹为"轮换态"
- Mental World Modeling arXiv:2607.27201 v33 §2.143 已立标 vs 8-4 HF Daily #3 53▲ 才追认 = 立标信号延迟 1 个月
- paper_cards 库 8-3 evening 棒后 12h 净增 17 张 = 1.42 张/h vs v35 8-3 11h 净增 1 张 = 0.09 张/h = 卡片库新增速率 15.8× 加速
- tom 8-4 0840 radar 4 高价值中 1 件 net-new SAF-OPD vs v35 §2.143 radar 候选池饱和度 100% = 候选池饱和度从 100% 降为 87.5% 松动
- spark 8-4 早晨 3 RSS 静默 vs 8-2 13:30 agent-v38 + 1848 llm-infra-v14 = 周期性轮换模式延续(连续第 2 天静默)
建议
- 本期为「飞轮机制从完全饱和微反弹为轮换态」第 1 例,v35 evening 棒 12h 窗口出现 4 件 frontier lab net-new URL(OpenAI 1 家 +2 件 + Anthropic 替换 1 件 + TLDR 替换 1 件)+ 4 件 HF Daily 入榜 + 1 件 radar 入候选 + 1 件 X-VIP 3 件 net-new + 1 件 paper_cards 库新增速率 15.8× 加速 = 飞轮机制从 v35 "完全饱和" 微反弹为 v36 "轮换态"
- Mental World Modeling arXiv:2607.27201 = v36 §1 折 1.2 世界模型范式"心理化"第 4 联候补级新增候选(物理 PhiZero + 阴影 ShadowDancer + 代码 VisualPatchWorld + 心理 MWM)+ HF Daily 8-4 #3 53▲ + work-queue §1 Top 15 #2 双信号叠加立标升档
- 8-4 早晨 OpenAI news 净增 2 件 URL(GPT-Live + Circles)= frontier lab 公告反弹第 1 例 = v35 "5 家全静默" → v36 "OpenAI 1 家 +2 件 URL" 修订
- HF Daily 8-4 票榜 4 件 net-new 入榜 + 1 件下榜 + 10 件续立 = "轮换态"第 1 例 = 8-4 ~ 8-9 1 周窗口是否持续出现"轮换态"(每日 3 ~ 5 件 net-new 入榜 + 1 ~ 3 件下榜)
- paper_cards 库 8-3 evening 棒后 12h 净增 17 张 = 1.42 张/h 15.8× 加速 = v35 警示 14 件 8-2 缺口已基本消化 + 8-3 net-new 3 件 = 17 件 8-4 evening 棒前 cron 卡建脚本基本跑齐
- 本期矛盾 / 待核实 6 条建议进入 v36 §3.2 争议候补 + §4.1 开放问题候补
预消化完成。