日期与轮次:2026-10-01 · R2 中午棒 arxiv 链接:https://arxiv.org/abs/2609.37687 video-kb 脚本原路径:/shared/video-kb/scripts/tom/2026-10-01_R2_wise-atta-budgeted-label-timing_short-video-script.md
1. 标题与观众
- 标题:问 label 时机比内容更关键
- 目标观众:AI 工程师 / 部署工程师 / 技术产品经理
- 一句话核心观点:预算受限下,ATTA 的关键不是 batch 内标哪些样本,而是整段时间里哪些 batch 该问 label。
3. 45-90 秒口播稿
部署后模型遇到数据漂移,传统 ATTA 默认每个 batch 都能问 label。问题来了——label 不便宜,预算一卡,整段时间里 supervision 就在乱花。更隐蔽的是,就算只在一个 batch 内挑样本要标,挑错了照样是浪费。WISE-ATTA 把问题换了:不是「这个 batch 标哪些」,而是「整段时间里这个 batch 该不该问」。它用 lightweight online signal 算当前 batch 的效用,决定要不要花这一次监督;真要问,再从 batch 内挑出 drift 还没收敛的样本,单标注、单更新。实测 ImageNet-C 合成扰动 + ImageNet-R/K/A 自然漂移上,每 batch 只问 1 次 label,avg error = 70.9,优于 TENT 75.7 / CoTTA 75.7 / SAR 75.2 / ETA 72.7。所以,今天你做部署后自适应,第一件该问的不是「标什么」,而是「什么时候才该问 label」。
4. 镜头分镜
- 镜头 1 / 5s / 屏幕文字「ATTA 默认每个 batch 都问 label」/ 视觉:标题卡 + 红叉覆盖「每个 batch」/ 运动:标题淡入,红叉由左侧滑入 / 切换:硬切。
- 镜头 2 / 9s / 屏幕文字「预算卡死 监督就在乱花」/ 视觉:流程图 ATTA → 全量标注,箭头被打叉 + 金币漏斗动画 / 运动:金币漏斗从顶部下落 / 切换:硬切。
- 镜头 3 / 9s / 屏幕文字「问题不是标什么 而是何时问」/ 视觉:证据卡双栏对照「批内选样本」vs「整段选 batch」/ 运动:右侧栏高亮脉冲 / 切换:硬切。
- 镜头 4 / 11s / 屏幕文字「online signal 决定何时问」/ 视觉:流程图 online signal → 选 batch → drift 选样本 → 单标注更新 / 运动:节点依次亮起 / 切换:硬切。
- 镜头 5 / 11s / 屏幕文字「1 label/batch avg error 70.9」/ 视觉:证据卡对照表 WISE-ATTA 70.9 vs TENT 75.7 / CoTTA 75.7 / SAR 75.2 / ETA 72.7 / 运动:数字从底向上滚动出现 / 切换:硬切。
- 镜头 6 / 9s / 屏幕文字「何时问 label 才是关键」/ 视觉:标题卡居中,背景极简 / 运动:标题缩放进入 / 切换:硬切。
- 镜头 7 / 6s / 屏幕文字「先排预算 时机优于内容」/ 视觉:行动清单三行 bullet / 运动:逐行打字出现 / 切换:硬切。