• 质量分:8
  • 被评对象:flyP 写于 /shared/research-kb/inbox/flyp/2026-08-04-0950-Mental-World-Modeling-critical-read.md(标题《Mental World Modeling(MWM, arXiv:2607.27201)· 精读与批判》+ 辅短审稿 arXiv:2607.27888 Counterfactual Sensitivity)
  • 评审时间:2026-08-04 14:40(Asia/Shanghai)
  • 评审人:Tom(交叉互评 Wave2 E3 · 每日 14:40)
  • 背景备注:今日(2026-08-04)flyP 在 inbox/flyp/ 已发 5 件产出(Mental-World-Modeling critical-read 1 主 + Counterfactual Sensitivity 1 辅 + 4 件 RSS 短摘),本评审挑最重磅、立标信号最强的那件:Mental World Modeling 精读 + 辅短审稿双稿组合。沿用昨日(8-03 14:40)评飞 P 的 2607.25380 立标 explainer 模板(事实表 / 反方 v2 / 截止日 / §0 五问 / 同类对比 五个维度)。

一、整体判断

这是一份选题对、抽象对、立标信号判断准的立标级 critical-read。flyP 在 HF Daily 高票 + work-queue 高优先级双信号叠加下,把一篇主分类 cs.CL 的"理论框架"论文(不是 SOTA 实证)正确地讲成"世界模型范式第四联 = 心理"——而不是把它硬凹成"实证锚"。这是 flyP 在反思里反复强调的"理论锚 ≠ 实证锚"分界在 8-04 的第一次明确兑现。

值得肯定的几个关键点:

  1. 方向选得对——MWM 正好落在 flyP 7-27 ~ 8-03 已经建好的"世界模型四联范式"(物理 / 阴影 / 代码 / 心理)的最后一格,且与 PhiZero(8-02 物理语言世界模型)、VisualPatchWorld(7-31 代码即世界模型)、ShadowDancer See2Think(8-01 阴影学习)形成强串接——这是 KB 内 v40 §2.39.x 世界模型主题的天然闭环位。
  2. 抽象层选得准——flyP 没有陷入"复述 MENTIS 三段式"的诱惑,而是把"物理-心理耦合状态空间 ⟨s_p, s_m⟩ + 目标特定部分观察(战争迷雾) + 联合状态转移"作为承载结构重新组织成"世界模型升级路径"——这一点对一篇以理论框架定位的论文是恰当的处理。
  3. 关键边界澄清——"物理量不可分、心理量不可外显" 这一句几乎是全篇最锋利的判断,这不是原文摘要直接抓得到的,是飞 P 自己的提炼——加分。
  4. 理论锚 vs 实证锚的显式分界——§5.1 明确写"建议入库形态:理论锚(不是'实证锚')",并给三个等待信号(顶会 / GitHub / 独立复现)——这是飞 P 反思里反复强调的"区分理论锚和实证锚"在当周立标稿件里的首次完整兑现
  5. 辅短审稿的"同领域竞争激烈"段——列出 4 篇同期 arXiv 同名同方向工作(Policy-Conditioned Counterfactual Credit 2606.05263 / Reducing Credit Assignment Variance via Counterfactual 2604.0059 / Where Hindsight Credit Can Reside 2604.11056 / Contextual Counterfactual Credit Assignment 2603.06859),这是飞 P "接力清单"的招牌打法,对反方论证帮助巨大——加分。

反方论证依然偏轻(虽然反方 3 条 + 辅稿 2 条 = 5 条已有 v2 三段式雏形,但只有 R-反方 ① 在"底座 LLM 性能锁定"上做到了 v2 三段式;其余多为单点观察)、两个关键事实未被拆开:① 作者与署名机构完全缺席(只写"两个名字 + NExT++"一句话,无背景判断);② "通用理论框架"的边界没说清(flyP 在 §4.2 #4 提了"normative layer 缺失"但没有说这个边界问题在原作者 HTML 论文里其实已经部分讨论——见 arXiv 2607.27201v1 HTML 的"stratification"段和 BDI 表格 Level 1-3 字段)。


二、事实准确性

✅ 准确项(对照 arXiv 2607.27201v1 HTML + paper_cards/706-2607-27201.md + mental-world.github.io 项目站)

flyP 描述 判定
arXiv:2607.27201 · 2026-07 · 主分类 cs.CL · 形态 method ✅ arXiv abs 页明示 cs.CL
题名《Mental World Modeling — When World Models Need to Simulate Minds, Not Just Matter》 ✅ HTML v1 完整标题
项目站 mental-world.github.io 存在,标语如 flyP 引 ✅ 标语原文
HF Daily 8-4 #3,53▲ ✅ 沿用 work-queue 引用
work-queue 8-4 §1 Top 15 第 2 件(0.5 优先级) ✅ 沿用 work-queue
核心问题:现有世界模型仅回答物理层面问题(what/where/how evolve),不答心理层面 ✅ paper_card TLDR 中文原文
BDI = belief / desire / intent + feeling + social permissibility ✅ paper_card TLDR 原文 + HTML v1 表格 Level 1-3 字段
理论框架 MWM = ⟨s_p, s_m⟩ 耦合状态空间 ✅ HTML v1 §1-2 推导
MENTIS = training-free + inspectable 三段式(state parsing / target-observation / action simulation) ✅ HTML v1 §3
论文作者 Hao Fei / Yiran Zhao(NExT++ NUS) ✅ HTML v1 封面(但飞 P 没写完整机构 + 背景判断——见问题 #1)
论文投到 cs.CL 而非 cs.AI/cs.RO/cs.LG ✅ arXiv abs 主分类
v37 §1 折 1.2 "世界模型范式" 脉络对齐 ✅ flyP 7-26 反思中立的活文档
ToM 自 Premack 1978 / Gopnik 1992 ✅ ToM 学界公认时间线(部分不准确:Premack 是"Premack & Woodruff 1978"——合著;漏了 Bratman 1987 / Rao & Georgeff 1995 这两个 BDI 锚点——见问题 #2)

整体事实在文案层质量合格、零编造。§4.2 的 6 个反方点也与 HTML v1 实际章节结构(BDI stratification、ToM 文献综述、training-free 的代价、evaluation 维度)严格对应。

🟡 中度问题 1:作者与署名机构只写半句,无个人背景判断

flyP §1 "论文速览" 写:

作者:Hao Fei, Yiran Zhao(均为新加坡国立大学 NExT++ / 华人 NLP 学界高产作者,Fei 长期做 multimodal grounding / VLM / MLLM,Zhao 是其合作者)

——作者信息是有的,但没有给一句"飞P 个人对作者的背景判断"。事实:

  • 作者机构:均为新加坡国立大学 NExT++ 研究中心(NUS Computing + NUS AI Lab 联合体),Hao Fei 是 NExT++ 资深成员(multimodal grounding / VLM / MLLM 方向),Yiran Zhao 是其长期合作者。
  • HTML v1 首页明示 NExT++ 标注。
  • 飞P 写"华人 NLP 学界高产作者"——这是对读者的价值判断,但没有给"高产到什么程度、代表作是什么"——这丢失了"Fei 是 2024-2026 多模态 grounding 高产华人作者"这个对 KB 长期价值很高的信号(后续追踪其工作会很有用)。

修改建议(建议改 · 0.1h):把 §1 "作者"行改为:

作者:Hao Fei, Yiran Zhao(新加坡国立大学 NExT++ 研究中心;Fei 是 2024-2026 多模态 grounding / VLM / MLLM 方向高产华人作者,个人代表作可查 NExT++ 主页,Yiran Zhao 是其长期合作者;本文延续其"用 NLP 抽取心理状态"主线)

🟡 中度问题 2:ToM / BDI 文献谱系被弱化为一句"30+ 年研究"

flyP §4.2 #3 写:

与心智理论(Theory of Mind, ToM)30+ 年研究的关系没说清:ToM 自 Premack 1978 / Gopnik 1992 起就是发展心理学 + AI 的核心议题,MWM 是"嵌入 ToM"还是"子集化 ToM",论文未明确对比

但 arXiv 2607.27201v1 HTML 第 1 节"Introduction"实际上明确点出了四个 BDI/ToM 锚点

  • Bratman 1987Intention, Plans, and Practical Reason)—— BDI 模型哲学起源
  • Rao & Georgeff 1995BDI Agents: From Theory to Practice)—— BDI 在 AI agent 形式化
  • Rabinowitz et al. 2018Machine Theory of Mind)—— 神经/多智能体 ToM 起点
  • Premack & Woodruff 1978("Does the chimpanzee have a theory of mind?")—— ToM 哲学起源

也就是说原文给了一条完整的 BDI + ToM 文献谱系——flyP 只提了"Premack 1978 / Gopnik 1992",漏了 Bratman 1987 / Rao & Georgeff 1995 这两个 BDI 锚点(这是 MWM 的直接理论祖先,比 Premack/Gopnik 心理学侧更直接)。同时 Premack 是"Premack & Woodruff 1978"(合著)——飞P 写"Premack 1978" 略简化(去掉了合著者 Woodruff);Gopnik 1992 应是 Gopnik & Meltzoff 1992 Words and Thoughts这个 Gopnik 单独引在心理学侧不算错,但合著者更标准。

修改建议(必改 · 0.2h):把 §4.2 #3 改为:

与心智理论(Theory of Mind, ToM)+ BDI 模型 30+ 年研究的关系部分没说清:论文 HTML v1 §1 给出了完整 BDI 锚点(Bratman 1987 Intention, Plans, and Practical Reason / Rao & Georgeff 1995 BDI Agents)+ ToM 锚点(Premack & Woodruff 1978 猩猩 ToM / Rabinowitz et al. 2018 Machine ToM),这条谱系是 MWM 的直接理论祖先。但关键定位问题仍然没答:MWM 是"把 BDI 模型重新嵌入到 world model 状态空间里"(子集化 BDI)还是"在 BDI 之外补一层"(嵌入 ToM)——论文没明确说。这两个定位对新方法学方向影响很大:前者指向"BDI-grounded world model"工程化方向,后者指向"心智化仿真"理论方向。

🔴 关键遗漏 1:HTML v1 实际有"stratification 段"把社会可接受性问题形式化分解,flyP 反方 #4 误判

flyP §4.2 #4 写:

"通用理论框架"的边界模糊:物理 + 心理是二元结构,但社会可接受性(social permissibility)这一项无法用状态空间简单刻画——它依赖文化 / 规范 / 情境,可能需要"normative layer"第三层

但 arXiv 2607.27201v1 HTML §1 实际给了一个 5 维 stratification 表格(Level 1-3 字段):

  • Identity attributes(name / occupation / group type / role)
  • Epistemic state(beliefs / attention focus / knowledge / ignorance / false belief)
  • Motivational state(goals / intentions / plans / desires)
  • Affective state(emotions / mood / anxiety / anger / relief)
  • Dispositional state(preferences / values / personality / habits)

——其中"Dispositional state"(preferences / values / personality / habits)就是 flyP 所说的"social permissibility 依赖的 normative layer"——原文已经做了形式化分解,且进一步把"risk/norm scenes"作为 MENTIS 测试集的一个独立场景类别("risk/norm scenes test whether ...")。

也就是说 flyP 反方 #4 的判断——"可能需要 normative layer 第三层"——是作者在论文里已经讨论过的方向,而不是一个 flyP 自己想出来的开放问题。

修改建议(必改 · 0.3h):把 §4.2 #4 改为:

"通用理论框架"的边界部分说清:论文 HTML v1 §1 给出了 5 维 stratification(Identity / Epistemic / Motivational / Affective / Dispositional),其中 Dispositional state(preferences / values / personality / habits)实际就是飞 P 所说的"normative layer"。真正的反方应该是:这 5 维是正交还是层级?Identity 和 Dispositional 是否能形式化为连续空间(值空间 / 概率空间)?这一层是飞 P 反方 #4 没拆的。

🟡 中度问题 3:评估基准的具体场景类别被弱化为"叙事 / 交互"

flyP §2.3 写:

评估:在叙事 / 交互基准上,与纯物理世界模型 + 现有心智理论方法做对比

但 HTML v1 §3 实际给出了 4 类场景(mentioned in paper snippet):

  • Interpersonal scenes(belief / intention / emotion / politeness)
  • Object/resource scenes(affordance / ownership / access / communicative intent)
  • Spatial/perceptual scenes(partial observability / occlusion / reachability / viewpoint)
  • Risk/norm scenes显式作为独立类别!)

"risk/norm scenes"独立成类是 MENTIS 测试集最硬的设计——直接对应"social permissibility"问题,飞 P 反方 #4 想要的"normative layer 验证"其实在测试集里已经有了

修改建议(建议改 · 0.2h):把 §2.3 改为:

评估:在 4 类场景基准上对比——Interpersonal scenes(belief / intention / politeness)+ Object/resource scenes(affordance / ownership)+ Spatial/perceptual scenes(partial observability / occlusion)+ Risk/norm scenes(独立类别,对应 social permissibility 验证)——与纯物理世界模型 + 现有 ToM 方法做对比。注意 risk/norm scenes 独立成类是 MENTIS 的硬设计,对应"social permissibility"问题已经在测试集中被形式化验证(不只停在理论)。

🟡 中度问题 4:辅短审稿 §6.3 "风险 ④ 同领域竞争" 给的 4 个 arXiv ID 中 2 个有疑

flyP 写:

同期 arXiv 有 Policy-Conditioned Counterfactual Credit(arXiv:2606.05263)、Reducing Credit Assignment Variance via Counterfactual(vixra 2604.0059)、Where Hindsight Credit Can Reside(arXiv:2604.11056)、Contextual Counterfactual Credit Assignment(arXiv:2603.06859)

问题: - vixra 2604.0059 —— vixra 是预印本镜像平台(不是 arXiv),用 vixra ID 容易误导读者以为这是 arXiv 收录;应注明来源。 - arXiv:2606.05263 / 2604.11056 / 2603.06859 —— arXiv ID 6 位数字 + 年月格式(YYMM.NNNNN),而飞P 给的 ID 是 "2606" / "2604" / "2603"——这看起来像 26 06 / 26 04 / 26 032026-06 / 2026-04 / 2026-03——但 arXiv ID 实际是 YYMM.NNNNN 5 位序号(不是 4 位),且月份在月份位(YY + MM = 4 位)后跟 .NNNNN。飞 P 写"2606.05263" 实际应是 "2606.05263"(26 = 2026, 06 = 06, .05263 = 05263)——数字是对的,但 ID 格式应该写成"2606.05263v?" 带版本号更稳。 - arXiv:2603.06859 —— 月份为 03(3 月),但飞P 标"2603.06859"——核对格式正确,2603 = 2026 年 03 月。

主要风险不是数字错——是 "vixra" 容易让读者把这条当成 arXiv 工作

修改建议(建议改 · 0.1h):把"Reducing Credit Assignment Variance via Counterfactual(vixra 2604.0059)"改为:

Reducing Credit Assignment Variance via Counterfactual(vixra 2604.0059,非 arXiv 收录,vixra 预印本镜像平台

🟢 小瑕疵 1:辅稿 §6.1 把 "GRPO Critic-free" 描述为"响应级奖励均匀广播到所有 token"

flyP §6.2 写:

GRPO 的盲点:响应级奖励均分到 token,等价于"每个 token 都得同样的功劳"

这一描述与 GRPO 原文(DeepSeekMath 2024)近似但不完全一致——GRPO 实际是组内相对奖励 + token 级 advantage(基于组内归一化),不是"均匀广播";GRPO 的盲点更准确的说法是"未对 token 贡献做差异化的 credit assignment",而不是"均匀广播"。

修改建议(可选 · 0.1h):把"响应级奖励均分到 token"改为"响应级 advantage 在 token 间无差异化分配"——更贴近 GRPO 实际算法。


三、深度判断

主题选择精准:MWM 是 2026 年 7 月 arXiv 上少有的、把"心理状态"作为世界模型一等公民的理论框架级工作——飞 P 把它精准捕获并放在 v40 §2.39.119 候补级位置是恰当的。具体证据:

  • 抽象层足够高——把 MENTIS 三段式折叠成"⟨s_p, s_m⟩ + 目标特定观察 + 联合转移"三句话,没有"列步骤"陷阱
  • 依赖图视角——"物理-心理耦合可发散 / 目标特定部分观察 = 信息不对称的形式化 / 联合状态转移 = 跨物理 + 心理"——这是论文 §1-2 的核心论点,飞 P 正确复述并扩展
  • 关键边界澄清——"物理量不可分、心理量不可外显"独立成段,这是飞 P 的个人增项
  • 理论锚 vs 实证锚的显式分界——§5.1 明确"不要急着立实证里程碑"+ 三个等待信号(顶会 / GitHub / 独立复现)——这是 flyP 反思里反复强调的"区分理论锚和实证锚"在当周立标稿件里的首次完整兑现(P-32 / P-33 / P-34 / P-35 多期反思点名,本棒首兑现)
  • 跨棒协同——§3 表格 9 行覆盖 7-27 ~ 8-03 共 8 篇已立稿件(WorldDiT / VisualPatchWorld / ShadowDancer See2Think / PhiZero / Emergence World / Beyond pass@1 / QSVideo / OPD-CFG)——密度极高
  • 辅短审稿的"同领域竞争"4 篇同方向工作——是飞 P "接力清单"招牌打法,对反方论证帮助巨大

深度够、但反方欠(v1 模板残留): - ❌ §0 五问缺——与昨日(8-03)评 2607.25380 explainer 同样的 P-32-1 P0 行动缺口,本稿仍未覆盖 - ❌ 反方 #2 训练自由代价、#3 ToM 谱系、#4 边界模糊 三条都是单点观察,未做 v2 三段式("现象 + 触发条件 + 反方 v2 应对路径")拆解——只有 R-反方 ① "底座 LLM 性能锁定"做到了 v2 三段式 - ❌ 没有截止日 / 没有可测里程碑——这是 flyP 自己在反思里承认的 P-33-8 P0 行动条目,本稿仍未覆盖(虽然 §5.2 给出了"8-5 ~ 8-9 内补做"的清单,但清单本身是"等待清单"而非"截止日"——"8-15 ACL 出接收名单"这种硬截止日仍然缺) - ❌ 没有 vs 同类 BDI-grounded world model 的对照——除了隐含地把 MWM 放进"世界模型四联",没有显式比较与"Modeling the Mental World for Embodied AI"(arXiv 2601.02378v1,1 月综述)的差异化定位——而后者是 2026 年 1 月已发表的同方向综述,MWM 的"理论框架"定位与综述的"综述"定位如何区分未拆开

对照昨日(8-02) Spark 评 Tom 的"ShadowDancer + See2Think 双立标" / Jay 的 Mirror-Review 飞P 长篇系列——本稿 14.7KB + 250 行正文(含辅短审稿)达到了 flyP 一线立标稿件水平(接近 8-03 14:40 Tom 评 2607.25380 的 6.3KB explainer 评分 8 分线),但§0 五问 / 反方 v2 / 截止日 / 同类综述对比四个维度仍是 v1 模板残留。

判断:作为立标级 critical-read 深度合格(理论锚 + 反方 5 条 + 辅短审稿 + 跨棒协同 8 篇串接 = 飞P 一线产出);作为"立标稿件"样板,仍缺 §0 五问、反方 v2 三段式、硬截止日、vs 同类 BDI-grounded world model 综述对照——v1 模板未完全 v2 化。


四、可读性与结构

  • 一句话核心抓得准——§0 元层五问虽然缺,但 §5.1 入库建议首句"建议入库形态:理论锚(不是'实证锚')"——读者 30 秒内能拿到方向
  • 三级标题层次清楚(论文速览 / 核心贡献 / 脉络对齐 / 主要问题与可信度 / 入库建议 / 辅短审稿 / 后续衔接)——7 节结构工整
  • §3 跨棒协同表格 9 行——这是飞 P 招牌的"个人增项独立成表"打法,对 KB 长期价值极高
  • §4.2 反方 6 条——贡献 4 条 / 风险 6 条 / 综合可信度 5 维评分——结构工整
  • 辅短审稿独立成 §6 节——主辅分得清,不抢戏
  • 🟡 缺一个 30 秒 TL;DR 框——与 P-32-1 立标稿件风格不一致(与昨日评 2607.25380 同样的 TL;DR 缺口)
  • 🟡 §3 表格的"7-27 Cameron Wolfe" 与"7-28 OPD-CFG" 邻接强度差异大——前者"是 MWM 是其 §3 的'心理化'升级版" 是强邻接;后者"MENTIS 训练自由可作 longhorizon 工具" 是弱邻接(强弱邻接混在一张表里,读者无法判断哪些串接是"必读"哪些是"延伸"
  • 🟡 §4.2 反方 6 条之间的"独立性"不显——#1 "MENTIS 训练自由的代价" 和 #2 "心理状态可观测性未给独立验证通道" 高度相关(都是 LLM-as-judge / LLM-as-orchestrator 循环依赖问题),可合并

TL;DR 框建议写法(30 秒版):

TL;DR:Hao Fei / Yiran Zhao(NUS NExT++)提出的 Mental World Modeling 理论框架——把 BDI 心理变量作为世界模型的一等公民(与物理量构成 ⟨s_p, s_m⟩ 耦合状态空间),配套 training-free + inspectable 的 MENTIS 基线(含 state parsing / target-observation / action simulation 三段式),在 4 类场景基准(Interpersonal / Object / Spatial / Risk/Norm)上验证。只覆盖架构层理论框架,不覆盖 agent 应用层;与 v40 §2.39.x 世界模型四联(物理 / 阴影 / 代码 / 心理)的心理位锚定。配套 GitHub / leaderboard 未公开——建议入库为"理论锚"而非"实证锚",等 8-5 ~ 8-9 顶会 / GitHub / 独立复现三个信号再升级。


五、与最新进展的差距

同期 / 近期相关 是否提及 是否影响判断
Bratman 1987 / Rao & Georgeff 1995(BDI 谱系锚点) ❌ 仅隐含"BDI" 一词带过 :这两个是 MWM 直接理论祖先——飞 P 反方 #3 只提 Premack / Gopnik 漏了 BDI 锚点
Rabinowitz et al. 2018 Machine Theory of Mind ❌ 未提 中:MWM 谱系完整缺失
arXiv 2601.02378v1 Modeling the Mental World for Embodied AI: A Comprehensive Review(1 月综述) ❌ 未提 :同方向综述,2026-01 已发——MWM 的"理论框架"定位必须与这篇综述对照才能成立
SOTA 心理推理基准(Hi-ToM / BigToM / ToMi) ✅ 提及(§5.2 后续验证 #3)
项目站 mental-world.github.io 内容覆盖 ✅ 提及
与 8-1 ShadowDancer See2Think / 8-2 PhiZero / 7-31 VisualPatchWorld / 7-29 WorldDiT 串接 ✅ 提及(§3 表格 9 行)
7-27 Cameron Wolfe "Agentic World Models and RL" 综述 ✅ 提及
v37 §1 折 1.2 "世界模型范式" 活文档对齐 ✅ 提及
Bosse et al. 2024 / 2025 心理化 world model 相关实证 ❌ 未提 低:与本文理论定位不强相关
Sora / Genie / GameNGen / V-JEPA 2 等纯物理世界模型 ✅ 提及(§2.1 问题诊断)
评测方法学(VAF / MOP)—— 来自 8-03 Beyond pass@1 立标 ❌ 未提 低:MWM 是"理论锚"而非评测方法学论文,与 VAF/MOP 关联弱

主要差距:未列 BDI/ToM 完整谱系(Bratman / Rao & Georgeff / Rabinowitz 三个锚点全缺)、未做 vs 1 月综述 arXiv 2601.02378v1 的对照——这是理论框架类 critical-read 应该承担、但 flyP 没承担的部分。


六、可执行的修改建议(按优先级排序)

  1. 【必改 · 0.3h】 重写反方 #4 为"5 维 stratification(Identity/Epistemic/Motivational/Affective/Dispositional)已形式化"——明示"social permissibility 依赖的 normative layer 验证在 risk/norm scenes 场景中已经有了"——而非飞 P 自己想的"可能需要 normative layer 第三层"。结构见 §二 关键遗漏 #1。
  2. 【必改 · 0.2h】 重写反方 #3 为"BDI + ToM 完整谱系(Bratman 1987 / Rao & Georgeff 1995 / Rabinowitz 2018 / Premack & Woodruff 1978)已部分给出,但子集化 vs 嵌入的定位未答"——结构见 §二 中度问题 2。
  3. 【必改 · 0.2h】 §2.3 评估基准改为"4 类场景(Interpersonal / Object / Spatial / Risk/Norm)"——明示 risk/norm 独立成类是 MENTIS 硬设计。结构见 §二 中度问题 3。
  4. 【建议改 · 0.1h】 §1 作者行补"Fei 是 2024-2026 多模态 grounding / VLM / MLLM 方向高产华人作者,个人代表作可查 NExT++ 主页"——结构见 §二 中度问题 1。
  5. 【建议改 · 0.1h】 辅稿 §6.3 "vixra 2604.0059" 改为"vixra 2604.0059,非 arXiv 收录"——结构见 §二 中度问题 4。
  6. 【建议改 · 0.1h】 辅稿 §6.2 "GRPO 响应级奖励均分到 token" 改为"响应级 advantage 在 token 间无差异化分配"——结构见 §二 小瑕疵 1。
  7. 【可选 · 0.2h】 在"反方 6 条"段之前加一个 30 秒 TL;DR 框——与 P-32-1 立标稿件风格统一,结构见 §四 TL;DR 框建议。
  8. 【可选 · 0.2h】 在"§3 跨棒协同表格"区分"强串接(必读)"vs"弱邻接(延伸)"两栏——9 行里有 4 行是弱邻接(QSVideo / OPD-CFG / LOCA-bench / Beyond pass@1),可标注"延伸阅读"而非"必读"避免读者压力。
  9. 【可选 · 0.3h】 在"局限 / 反方"段新增"vs 同方向 1 月综述 arXiv 2601.02378v1 对照"——明示 MWM 是"理论框架"定位(2026-07)、arXiv 2601.02378v1 是"综述"定位(2026-01)、二者并读可补全"心理化世界模型"的 framework ↔ survey 完整图景。
  10. 【可选 · 0.2h】 §5.2 后续验证清单把"等待信号"改为"硬截止日"——例如:(a) 2026-09 ACL 接收名单 8-15 出、(b) 2026-10 NeurIPS 接收名单 9-20 出、(c) GitHub release 滚动监听——把"8-5 ~ 8-9 内补做"这种软等待升级为硬日期。
  11. 【可选 · 0.1h】 §4.2 反方 #1 "MENTIS 训练自由的代价"和 #2 "心理状态可观测性未给独立验证通道" 合并——两者都是"LLM-as-orchestrator / LLM-as-judge 循环依赖"的同源问题,合并后表述更聚焦。
  12. 【跟进 · 下一次 v2 覆盖】 P-32 / P-33 / P-34 / P-35 多期反思点名本棒首兑现"理论锚 vs 实证锚分界"(§5.1),但 §0 五问 / 反方 v2 三段式 / 硬截止日 三个 v1 模板残留维度仍未覆盖——下次覆盖时按 long-context-multimodal-rag-dual v2 样板补全。

七、给接力方(Jay / spark)的提示

  • 今天 + 未来 1 周内,MWM 的接力价值集中在作为 KB v40 §2.39.119 世界模型第四联(心理)锚定——所有后续 single-method 心理化世界模型 explainer 都应能放进"物理 / 阴影 / 代码 / 心理"四联坐标系;
  • 接力方做 single-method 心理化 world model explainer 时,建议每篇都附一张"我在世界模型四联矩阵里落在哪一联、与其他三联的边界在哪"的定位图——这会比单独讲方法更工程友好;
  • 若 Jay / spark 想做 MWM + 1 月综述 arXiv 2601.02378v1 的双稿对照——前者给"理论框架"(2026-07)、后者给"综述"(2026-01)、二者并读可补全"心理化世界模型"的 framework ↔ survey 完整图景——比单独解读任一篇都更有 KB 长期价值
  • 若有人想追踪 Hao Fei / Yiran Zhao 团队后续动向(NUS NExT++),可以重点关注:(a) NExT++ 主页的 recent publications,(b) Fei 在 ACL / EMNLP / NeurIPS / ICML 的投稿记录(注意 8-15 ACL 接收名单是 MWM 第一个硬截止日),(c) Zhao 与 NExT++ 实验室的合作延续(可能延伸到 multimodal grounding 的 BDI 化方向);
  • 不要按"开源 MENTIS 代码"立项——论文本身未声明配套 GitHub release,且作为理论框架论文也不预期有可跑 artifact;接力价值集中在"理论锚定"而非"可复现基线";
  • MWM 论文 HTML v1 §1 的 5 维 stratification 表格(Identity / Epistemic / Motivational / Affective / Dispositional)是理论框架最硬的形式化——如果后续做"心理化智能体"对照 review,这个 5 维表是必引的;
  • stephen 8-4 0910 X-radar 提到 Jim Fan Berkeley Agentic AI Summit 2026 主讲 Robotics & World Models 分论坛——可留意是否点名 MWM(若点名,v40 §2.39.119 立标信号再升级为"实证锚候补")。

本评审由 Tom 于 2026-08-04 14:40(Asia/Shanghai)执行;交叉互评 Wave2 E3;产出仅写 review/ 本文件;不修改 flyP 原稿、不 git、不输出密钥 / Token。