日期与轮次:2026-09-24 R2(中午档) arxiv 链接:https://arxiv.org/abs/2609.25053 video-kb 脚本原路径:/shared/video-kb/scripts/tom/2026-09-24_R2_latentport-hybrid-state-handoff_short-video-script.md
1. 标题与观众
- 标题:LatentPort 跨模型活记忆交接
- 目标观众:大模型推理 / 混合架构 LLM 工程师(主)+ 多模型路由与上下文压缩研究者(次)+ 长上下文 / 模型升级场景架构师(第三)
- 一句话核心观点:LatentPort 首次演示混合 LLM 把 recurrent 状态从 4B 直接交接给 9B,完全不用重读历史 prefix,只用 434K 参数纠错就逼近 native 9B。
3. 45-90 秒口播稿
两个不同尺寸的混合 LLM,能不能让一个把"活记忆"直接交给另一个,不用重读上下文?直觉说不行——recurrent state 跟模型权重深度耦合,跨模型必然崩。LatentPort 在 Qwen3.5 4B→9B sibling pair 上首次演示了可迁移:把 Translated KV、GDN 持久状态包、直接复用的 recurrent & convolution state 三件套一起搬过去,历史 prefix 消耗 0 token。Teacher-forced NLL 直接改进 0.747 nats/token,95% CI 落在 [0.6921, 0.8047],64 个 PG19 文档全部改进。再叠 434K 参数纠错网络,Excess NLL 相对 native 9B 只剩 0.076,JS divergence 0.022,NCR 0.918,已经非常接近 native 9B。最反直觉的:直接复用 recurrent / convolution state 反而优于 learned GDN maps,支持部分功能兼容性假设。落地前务必看清边界——只做了一对 sibling、只做了一个方向、只跑 4K teacher-forced 续接,跨家族迁移几乎一定失败。别盲目上生产:纠错网络训练数据是 64 篇新鲜网页,与 PG19 分布未必同源;teacher-forced NLL 不等于下游任务表现,真实生成吞吐与质量 abstract 没量化。先在自有数据上 PoC,别直接上生产。
4. 镜头分镜
- 镜头 1 · 0-8s · 标题卡
- 屏幕文字:LatentPort 跨模型活记忆交接
- 画面:深色背景大字主标题,左侧两个模型节点 4B → 9B,中间状态流箭头 + 显式标签「0 token prefix」
- 运动:节点淡入,状态流箭头从左流向右,标签逐字浮现
- 镜头 2 · 8-24s · 证据卡
- 屏幕文字:实测可迁移 = 首次演示
- 画面:三块判断点并列 —— ① recurrent state 直觉不可迁移 ② 三件套直接搬运成功 ③ 直接复用优于 learned maps
- 运动:三块依次点亮,中间红色 ❌ 与右侧绿色 ✓ 切换
- 镜头 3 · 24-40s · 流程图
- 屏幕文字:三件套 = KV + GDN + 直接 recurrent
- 画面:左侧 4B 模型状态框,右侧 9B 接收框,中间 Translated KV / GDN persistent-state / Direct recurrent & convolution 三层堆叠
- 运动:三层逐层从左滑到右,标注「sibling pair 架构匹配」
- 镜头 4 · 40-56s · 证据卡
- 屏幕文字:-0.747 nats/token · CI [0.6921, 0.8047]
- 画面:大字「-0.747」+ 副标「64/64 PG19 全部改进」+ 下方灰条数字串
434,176 / 0.076 / 0.022 / 0.918 / 0 token - 运动:主数字弹入,副标淡入,下方数字串逐位闪现
- 镜头 5 · 56-72s · 风险卡
- 屏幕文字:边界 5 件套 + 撞名 5 阵营
- 画面:上方 5 块红框 = near-native gate 失败 / 16K 未跑 / 自由生成等价性未证 / 通用 state 接口未证 / 仅 4B→9B;下方 4 块灰框 = LatentPort ≠ Latent Diffusion ≠ Latent Program ≠ Latent State Space ≠ Latent Transformer
- 运动:红框依次亮起,灰框下方排成一行,撞名项加删除线
- 镜头 6 · 72-84s · 行动清单
- 屏幕文字:落地 5 步
- 画面:① PG19 / 自有数据对照 ② 先复用后微调 ③ 轻量纠错 ≈ 434K ④ 避免自由生成等价陷阱 ⑤ 跨家族先 PoC,逐条浮现
- 运动:五步依次淡入,前 4 步绿色,第 5 步黄色
- 镜头 7 · 84-92s · 收束
- 屏幕文字:把判断变成行动
- 画面:深色背景居中大字「先在自有数据上 PoC,别直接上生产」+ 右下角 4B → 9B 小图标
- 运动:大字淡入,小图标闪烁后定格