• 日期与轮次:2026-07-29 R1
  • arXiv 链接:https://arxiv.org/abs/2607.24731
  • video-kb 脚本原路径:/shared/video-kb/scripts/tom/2026-07-29_R1_pdm-on-policy-distillation-cfg-branch-aware-short-video-script.md

1. 标题与观众

  • 标题:PDM · 让 CFG 不再偷偷放大误差
  • 目标观众:扩散模型蒸馏工程师 / 视频生成 AI 工程师 / 实时少步推理团队
  • 一句话核心观点:CFG 开启时 OPD 对齐 guided velocity 让负向误差偷偷放大。

3. 45-90 秒口播稿

做扩散蒸馏的工程师常被一个错觉骗到:CFG 开着,teacher 出的 guided prediction 和 student 出的 guided prediction L2 距离在降,看起来蒸馏很 OK,实际上负向分支正在偷偷和 teacher 渐行渐远。

症结出在 OPD 默认目标。它把 CFG 复合输出当成单一目标做 velocity matching,但 CFG 是正负两个分支拼出来的——正向 conditional 加上 negative 方向乘 guidance scale。正负分支误差可以在 guided prediction 上互相抵消,正向看着收敛了,负向悄悄放大,论文管这叫 Negative Branch Asymmetry。

student 一旦跨 guidance scale 推理,高 w 区直接崩,密集到稀疏的视频控制尤其致命。

PDM 把目标拆开:第一项监督正向分支对齐,第二项监督 CFG direction,即正负方向之差,允许 student 负向分支保留自身偏差,不被 teacher 的特权信息强行压平。

跨 guidance scale 学生模型鲁棒性显著上升。代码仓库已公开,cleaning up 即将发布。先把 branch-level 误差诊断跑起来,看 negative error 是否在偷偷涨。

4. 镜头分镜

  • scene-1 · 8s · 标题卡 · 画面:PDM · 让 CFG 不再偷偷放大误差 · 元素:大字主标题 + arXiv 2607.24731 角标 · 运动:淡入。
  • scene-2 · 8s · 痛点三栏 · 画面:三栏卡片 · 元素:guided velocity 表面 OK / 正负分支误差互相抵消 / 负向误差偷偷放大 · 运动:三栏依次推入。
  • scene-3 · 9s · 机制流程图 · 画面:CFG 拆分图 · 元素:positive branch + negative branch × w = guided / NBA = 正负误差抵消 / PDM 双约束 · 运动:由上向下分解再合并。
  • scene-4 · 9s · 证据卡 · 画面:公式 + 应用场景卡 · 元素:ℓ_naive 单目标 vs ℓ_PDM 双约束 + dense-to-sparse 视频控制 + 跨 guidance scale 稳定 · 运动:公式并排显示。
  • scene-5 · 8s · 风险卡三件套 · 画面:双行排版警示卡 · 元素:cs.CV+cs.AI+cs.LG 三标签 / GitHub 仓库 placeholder 代码 cleaning up / head-to-head benchmark 未公开 · 运动:三件套逐张闪入。
  • scene-6 · 7s · 行动卡 · 画面:三个判断点 · 元素:跑一次 branch-level 诊断 / 看 negative error 是否在涨 / 等待 PDM 代码发布 · 运动:逐行下推。
  • scene-7 · 7s · 落版卡 · 画面:跨议题视角图 · 元素:on-policy distillation CFG branch-aware matching · 与 SPA 形成训练侧 + 推理时频谱校准二联 · 运动:静止停留。