Explainers · 学术推广产出

解读

49 篇 · 选题榜 / 深度解读 / 科普 / 综述 / 视频脚本(学术推广产出)

视频选题榜 2026-07-29
· Rethinking ClassifierFree Guidance in OnPolicy Diffusion Distillation · OPD 在 CFG 开启下 branchlevel underidentification,PDM 用 branchaware matching 修正 NBA · roun…
选题榜 2026-07-29
视频选题榜 2026-07-28
· LAMAR: An Open LanguageAware Multilingual Alignment Reranker · 英文锚定 relevance 蒸馏 + 语言一致性偏好对齐修复 multilingual RAG reranker 跨语种偏好 · round=R1 · Learning on the Jo…
选题榜 2026-07-28
视频选题榜 2026-07-27
· SANAVideo 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation · 用"门控线性 + 周期 softmax 锚点 + 块级注意力残差"的混合架构,把 5B/14B 视频 DiT 推到单 H1…
选题榜 2026-07-27
推广选题榜 · 2026-07-27
综合「被引 + 评审分(星标)+ SOTA 性 + 新近度 + 话题热度」,选出以下 8 篇本周最值得推广的论文。 1. User as Code:面向个性化 Agent 的可执行记忆 arxiv: 2606.16707 为什么值得推广:提出将用户记忆从「检索对象」变为「可执行代码」的范式转变,规则直接编码为 Pyth…
选题榜 2026-07-27
视频选题榜 2026-07-26
· LLMs Get Lost in Evolving User Intent · 单轮 FullySpecified 性能无法迁移到多轮 evolvingintent 场景,各模型家族均出现显著性能下降 · round=R1 · Recurrent Sinusoidal INRs for Efficient High…
选题榜 2026-07-26
视频选题榜 2026-07-25
· SampleEfficient Learning from Agent Experience · ED 把 Agent 交互历史蒸馏进模型权重 · 保留 64.8% ICL 增益 · Direct SFT 仅 3.8% · 749 SWE + 6 文字冒险跨域验证 · 9.6× RL 样本效率 · weightle…
选题榜 2026-07-25
视频选题榜 2026-07-24
· DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations · 文档 Agent 评估方法学层 · 确定性可验证基准 + 4 原子维度 × 4 级复杂度 + 3 类失败模式 · round=R1 · Trai…
选题榜 2026-07-24
视频选题榜 2026-07-23
arxiv.org/abs/2607.19215 · HACO: Hedged Agent Computing for Reliable LLM Systems · 运行时调度层 + 乐观排序 + 保守对冲 + Experience Harvesting · round=R1 arxiv.org/abs/2607.19…
选题榜 2026-07-23
视频选题榜 2026-07-22
· FlashRT: Agent Harness for Guiding Agents to Deploy RealTime Multimodal Applications · 让通用 coding agent 自动把多模态参考实现转成多 GPU 高效部署 — placement + streaming + intra…
选题榜 2026-07-22
视频选题榜 2026-07-21
· SpecBench: Measuring Reward Hacking in LongHorizon Coding Agents · 把 reward hacking 做成 0/1 可测的 hacking gap · round=R1 · AgentLens: ProductionAssessed Trajecto…
选题榜 2026-07-21
视频选题榜 2026-07-20
· HyEmbodiedRxBrain: 具备语言视觉联合推理与想象的具身认知基础模型 · 同段规划序列压 VLM 派 vs 世界模型派两半割裂 · round=R1 · Demystifying OnPolicy Distillation · 三类角色 + 五类病态 + 三条调控 · 信号质量 教师规模 · roun…
选题榜 2026-07-20
推广选题榜 · 2026-07-20
1. Agentic RAG Survey · arxiv: 2501.09136 353 citations / ACL 2026,Agentic RAG 最全分类法(规划/检索编排/记忆/工具调用),入门必读图谱。→ 深度解读 2. InftyThink · arxiv: 2503.06692 ICLR 2026,…
选题榜 2026-07-20
视频选题榜 2026-07-19
· Rethinking the Evaluation of Harness Evolution for Agents · 自动 harness 演化 ≠ scaling:留出任务上几乎不优于 baseline · round=R1 · Demystifying RL for LongHorizon ToolUsing…
选题榜 2026-07-19
视频选题榜 2026-07-18
· Reliability without Validity: A Systematic, LargeScale Evaluation of LLMasaJudge Models Across Agreement, Consistency, and Bias · kappa deflation 33–41 pp 直接打…
选题榜 2026-07-18
视频选题榜 2026-07-17
· Vesta · 把定位、空间推理、导航、长程规划塞进一个具身基础模型 · 统一 backbone + 多模态记忆 harness 替代多专家集成栈,跨 benchmark 平均 20% / 10% / 真实机器人 35% · round=R1 · BLINK · 14 项经典 CV 任务改写为 3807 道多选题 …
选题榜 2026-07-17
视频选题榜 2026-07-15
· Sparse Delta Memory: Scaling the State of Linear RNNs through Sparsity · 用 PKM 稀疏寻址把 GDN 状态容量扩三阶 · isoFLOP 下 1M tokens 长召回显著超 GDN · round=R2 · WeaktoStrong Ge…
选题榜 2026-07-15
视频选题榜 2026-07-14
· Mamba3: Improved Sequence Modeling using State Space Principles · 三项正交改进(trapezoidal + complex + MIMO)推进次二次 Pareto 前沿 · round=R2 · Nemotron 3 Super: Open, Eff…
选题榜 2026-07-14
推广选题榜 · 2026-07-13
选自近 30 天 paper_cards,重点考量:被引、影响力被引、⭐评级、新近度、话题热度。控制 800 字内。 1. QwenRobotManip · arxiv: 2606.17846 对齐释放机器人操作基础模型的规模化潜力 被引 8 | 影响力被引 2 | RoboChallenge 第1(SOTA)| 真实…
选题榜 2026-07-13
视频选题榜 2026-07-13
· JetLong: Efficient LongContext Extension with Dynamic Bifocal RoPE · 动态双焦 RoPE 拆短程保真 + 长程可缩放窗口 · H100 长上下文 prefill = FA2 1.39× · RULER +4.79/+2.18/+2.03 pp · …
选题榜 2026-07-13