2026-08-12 R2 · Encrypted-Reasoning-Block-Theft arxiv: https://arxiv.org/abs/2608.09867 video-kb 脚本原路径: /shared/video-kb/scripts/tom/2026-08-12_R2_encrypted-reasoning-block-theft-short-video-script.md
1. 标题与观众
- 标题:加密推理块 · 弱模型可解密强模型
- 目标观众:LLM 应用开发者 / LLM 平台安全与法务团队
- 一句话核心观点:同厂商生态内密文推理块完全可互换,弱模型会明文复述强模型推理过程。
3. 45-90 秒口播稿
你今天把加密推理字段上传 GitHub,以为看不见就安全?但 arXiv:2608.09867 抓了 315,320 个公开 reasoning 块,解出 367 条 PII、182 条凭据。原理很简单:头部厂商把推理链加密回传,客户端原样转发维持状态,但密文块在同一厂商生态内完全可互换。你把强模型密文塞给同厂商弱模型,弱模型会按上下文,把强模型推理过程以明文复述出来。Anthropic、OpenAI、Google 三家都中招。论文给出四类正交攻击:反蒸馏、私密数据、危险信息、不可见注入,任一项缓解都不能假设另外三项被解决。行动建议:永远不要把 reasoning 字段原样上传公开位置;日志管道与 agent 编排必须显式剥离。
4. 镜头分镜
镜头 1 · 开场冲突
- 时长:8s
- 屏幕文字:加密≠安全
- 画面元素:左半红色惊叹号 + 右半密文块流光动效
- 运动方式:密文块从屏幕右侧连续滚入左侧破框
镜头 2 · 机制可视化
- 时长:8s
- 屏幕文字:密文可互换
- 画面元素:强模型图标 → 加密块 → 弱模型图标 → 明文推理
- 运动方式:连线流动动画,弱模型图标高亮放大
镜头 3 · 数据证据卡
- 时长:8s
- 屏幕文字:315K 块 367 PII
- 画面元素:大数字逐个弹跳显示 + 来源标签 arXiv:2608.09867
- 运动方式:数字递增计数动画 + 来源小角标
镜头 4 · 三家厂商覆盖
- 时长:7s
- 屏幕文字:三家全中招
- 画面元素:三家 logo 三栏并排 + 红色对勾闪烁
- 运动方式:三栏同步脉冲高亮
镜头 5 · 四类攻击面正交
- 时长:9s
- 屏幕文字:四类攻击正交
- 画面元素:四象限矩阵图,每象限独立图标
- 运动方式:四象限依次旋转放大 + 中央交叉锁定线
镜头 6 · 责任归属
- 时长:8s
- 屏幕文字:日志须剥离
- 画面元素:左右双栏对比,左侧厂商图标 + 右侧开发者日志管道图标
- 运动方式:左右双向箭头连接,右侧高亮
镜头 7 · 行动清单
- 时长:8s
- 屏幕文字:别传 reasoning
- 画面元素:三步行动清单 + 绿色对勾逐个弹出
- 运动方式:清单项依次滑入 + 最终 logo 收尾