解读
49 篇 · 选题榜 / 深度解读 / 科普 / 综述 / 视频脚本(学术推广产出)
视频选题榜 · 2026-08-19
v2 重写覆盖(承接 20260825 反思棒 §三"最弱单篇"识别 · 覆盖原 v1 = 610 字节 / 4 行 / 3 entries · 物理粘连 + 内容塌方) 触发:20260825 21:40 CST Tom 反思棒次 #29 明确把 819 selection 列为 7 天剩余 v1 selection…
视频选题榜 2026-08-25
· IAR: Inject, Align, Recover · 免检索后训练三段式把文档压进参数 · round=R1 · Repo0 · DualDAG 设计驱动代码 Agent · Functionality Coverage +20.08pp · round=R1 · AIDGuard · stateful au…
推广选题榜 · 2026-08-25
本周从 795 篇近 30 天新卡片中综合评审分(机制 + 工程双轨)、话题热度与新近度,选出 Top 8。 1. FreeToken:带宽自适应执行的边缘原生 MoE 高效服务 arxiv: 2608.16157 边缘原生 MoE serving 系统,将个人设备视为统一弹性推理平台而非「小型 GPU」,把开放权重转…
视频选题榜 · 2026-08-18
v2 重写覆盖(承接 20260825 反思棒 §3 "最弱单篇"识别 · 覆盖原 v1 = 664 字节 / 4 行 / 3 entries · R1+R2+R3 物理结构 OK 但内容塌方) 触发:20260825 21:40 CST 反思棒明确把 818 selection 列为近 7 天剩余未覆盖 v1 sel…
视频选题榜 · 2026-08-23
v2 重写覆盖(承接 20260823 反思棒 §3 "最弱单篇"识别 · 覆盖原 v1 = 396 字节 / 4 行 / 2 entries / R2 缺位) 触发:20260823 21:40 CST 反思棒明确把 823 selection 列为 7 天最弱单篇 v1 双重塌方识别: 1. 形式塌方(模式 AD …
视频选题榜 2026-08-22
物理结构自检(v2 模式 AD 修复):v1 402B / 5 行 / 3 entries;v2 ~17.7KB / 多行 / 8 entries;每 entry 独占一行(v1 物理 OK,v2 加固) v1 selectionradar 脱钩对账(v2 必修复 · 已 822 21:40 E2 反思棒触发时核验):…
视频选题榜 · 2026-08-16
v2 重写覆盖(承接 20260821 反思棒 §3 "7 天最弱单篇"识别 · 覆盖原 v1 = 626 字节 / 4 行 / 23 entries / 5 段标配全缺) 触发:20260821 21:40 CST 反思棒明确把 816 selection v1 列为 7 天最弱 selection 单篇(820 棒…
视频选题榜 2026-08-21
· DecisionMetric Alignment in Latent World Models: Diagnostics and ActionConditioned Objectives for MPC Planning · JEPAMPC 潜码欧氏距离 ≠ 真实奖励排序 · PlanReal Spearman +…
视频选题榜 · 2026-08-14
v2 重写覆盖(承接 20260820 反思棒 §3"7 天最弱单篇"识别 · 覆盖原 v1 = 540 字节 / 9 行 / 3 entries / 与 814 T1440 v2 雷达 4 高价值 0 关联) 触发:20260820 21:40 CST 反思棒明确把 814 selection 列为 7 天(814 …
视频选题榜 2026-08-20
· Do Large Language Models Play Six Degrees of Separation? Measuring Topological Compression in LongContext Manifolds · deep LLM 潜空间天然组织为 SmallWorld 网络 + 任意语义锚点…
视频选题榜 · 2026-08-15
v2 重写覆盖(承接 20260819 反思棒 §3"7 天最弱单篇"识别 · 覆盖原 v1 = 545 字节 / 9 行 / 2 entries / 缺 R2 round) 触发:20260819 21:40 CST 反思棒明确把 815 selection 列为 7 天(813 ~ 819)最弱单篇 v1 4 重塌…
视频选题榜 · 2026-08-17
v2 重写覆盖(承接 20260817 反思棒 §5 "最弱单篇"识别 · 覆盖原 v1 = 357 字节 / 4 行 / 2 entries) 触发:20260817 21:40 CST 反思棒明确把 817 selection 列为 7 天最弱单篇 v1 4 重塌方识别: 1. 形式塌方:4 行 357B 单层列表…
推广选题榜 · 2026-08-17
本周从近 30 天入库论文中综合「被引 + 影响力被引 + 新近度 + 话题热度」精选,涵盖 Agent、AI Infra、机器人、视频多模态四大方向。 ① Gemma 4 Technical Report arxiv: 2607.02770 Google 推出的新一代开源权重原生多模态模型系列,在 STEM、多模态与…
视频选题榜 2026-08-13
· BDHCQ: InContext Learning with Recurrent Latent Reasoning · 把 ICL 与 latent reasoning 做进同一计算织物 · 150M + ARCAGI1 pass@2 29.5% / 单任务 $0.0007 把 costaccuracy Paret…
视频选题榜 2026-08-12
· Ouroboros: A SelfDeveloping Frontier Coding Agent with Reviewed Core Evolution · 自演化 Agent harness 用 review commit 治理 · round=R1 · Stealing Reasoning Traces f…
视频选题榜 2026-08-11
· SimWAM · 视频专家推理期剪枝 · 91.5 PDMS · zeroshot 迁移 nuScenes · round=R1 · HiSparse · 分层 KV 缓存扩展稀疏注意力解码 · up to 4.7× peak throughput · 已合入 SGLang 上游 · round=R2 · EvoB…
视频选题榜 2026-08-10
· RST (Recursive Synthetic Terminal Tasks) · 递归合成 37K terminalagent 任务 · 4 数量级降价到 $0.05/task · round=R1 · RoundTrip Consistency · 双向扩散单模型自检 rollout 误差 · 自监督免测量 …
推广选题榜 · 2026-08-10
基于近 30 天(2607·2608 批次)论文卡片,从「概念突破 × 话题热度 × 新近度」综合评估,Top 8 如下: ① Metis: Memory Foundation Model arxiv: 2607.26760 将 Agent 记忆从外部模块重新定义为模型原生能力——这是记忆研究方向的范式转换。传统记忆依…
视频选题榜 2026-08-09
· KVAE: Family of Tokenizers for Multimodal Generative Models · Kandinsky Lab 把音频/3D/2D 三件套 tokenizer 升级为可独立评测、跨模态统一比较的一等组件 · round=R2 · HarnessOptBench: Evalua…
视频选题榜 2026-08-08
· EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning · 同策略权重 prompt 切换扮演策略者+环境双角色,端到端优化绕开可执行环境,测试时私有预演作 CoT · rou…
视频选题榜 2026-08-07
· When Attention Goes Blind: Numerical Failure in ALiBi Positional Encodings · 位置编码线性 bias fp16/bf16 下溢导致 attention head 失明 · round=R1 · ABSeeker: Training Long…
视频选题榜 2026-08-06
· VideoDeepResearch: Towards the NextGeneration Multimodal Deepresearch Agent · 解耦 perceptionexploration pipeline + stagewise tool unlocking 强制先看视频再上网,35BA3B 64…
视频选题榜 2026-08-05
· LongHorizonHarness: Advancing LongHorizon Agents for RealWorld Tasks · LongHorizonHarness 把任务执行+状态追踪+完成评估三件混一个 context 重新建模为「外部任务状态管理问题」· MEA(ManagerExecuteAu…
视频选题榜 2026-08-04
· Keep It InMind: Benchmarking the ImplicitAssociation Blind Spot in Agent Memory · InMind 把长期记忆评测从「答对多少」推进到「该用时能不能找到」· 84.0% vs 14.4% vs ~100% 三件套 + embedding …
视频选题榜 2026-08-03
· Beyond Semantic Organization: Memory as Execution State Management for LongHorizon Agents · MAGE = 把 Agent 记忆从「语义相似度检索」重构为「分层执行状态树管理」+ Grow/Compress/Maintain/…
推广选题榜 · 2026-08-03
本周从近 30 天卡片中综合「被引 + 评审分 + SOTA + 新近度 + 话题热度」选出 Top 8。 1. User as Code:面向个性化 Agent 的可执行记忆 arxiv: 2606.16707 范式级想法:把用户记忆从「静态数据」变成「可执行代码」,Python 函数编码规则、对象承载状态,推理与执…
视频选题榜 2026-08-02
· MisKnowAgent: Is Deep Research Reliable? Misleading Knowledge Induces False Conclusions · 注入 1 篇误导文档 FCAR 平均飙升至 54.7% · 能识别 ≠ 会拒绝的工作流层失效模式 · round=R1 · Metis:…
视频选题榜 2026-08-01
· TurboVLA: RealTime VisionLanguageAction Model at 32 Hz on an RTX 4090 with <1 GB VRAM · TurboVLA 把 VLA 从 LLMcentric V→L→A 改写为 V+L→A 直接融合(DINOv3 + BERT 独立编码 + …
视频选题榜 2026-07-31
· SkillRise: Agentic Reinforcement Learning for CrossTask Skill Evolution · 跨任务技能演化训练范式 method paper · 单策略 solve+curate 双角色 + 解耦信用分配 + 跨任务测试时 scaling 现象 · round…
视频选题榜 2026-07-30
· CodeNib: A MultiView Data System for Serving Repository Context to Coding Agents · 编码 Agent 多视图仓库上下文服务 · commit 级 lexical/dense/structural 三视图 + 单一运行时 ranked …