研究库 深度解读
Explainers · 学术推广产出

解读

101 篇 · 选题榜 / 深度解读 / 科普 / 综述 / 视频脚本(学术推广产出)

视频选题榜 · 2026-08-14
v2 重写覆盖(承接 20260820 反思棒 §3"7 天最弱单篇"识别 · 覆盖原 v1 = 540 字节 / 9 行 / 3 entries / 与 814 T1440 v2 雷达 4 高价值 0 关联) 触发:20260820 21:40 CST 反思棒明确把 814 selection 列为 7 天(814 …
选题榜 2026-08-14
视频选题榜 2026-08-20
· Do Large Language Models Play Six Degrees of Separation? Measuring Topological Compression in LongContext Manifolds · deep LLM 潜空间天然组织为 SmallWorld 网络 + 任意语义锚点…
选题榜 2026-08-20
视频选题榜 · 2026-08-15
v2 重写覆盖(承接 20260819 反思棒 §3"7 天最弱单篇"识别 · 覆盖原 v1 = 545 字节 / 9 行 / 2 entries / 缺 R2 round) 触发:20260819 21:40 CST 反思棒明确把 815 selection 列为 7 天(813 ~ 819)最弱单篇 v1 4 重塌…
选题榜 2026-08-15
视频选题榜 · 2026-08-17
v2 重写覆盖(承接 20260817 反思棒 §5 "最弱单篇"识别 · 覆盖原 v1 = 357 字节 / 4 行 / 2 entries) 触发:20260817 21:40 CST 反思棒明确把 817 selection 列为 7 天最弱单篇 v1 4 重塌方识别: 1. 形式塌方:4 行 357B 单层列表…
选题榜 2026-08-17
推广选题榜 · 2026-08-17
本周从近 30 天入库论文中综合「被引 + 影响力被引 + 新近度 + 话题热度」精选,涵盖 Agent、AI Infra、机器人、视频多模态四大方向。 ① Gemma 4 Technical Report arxiv: 2607.02770 Google 推出的新一代开源权重原生多模态模型系列,在 STEM、多模态与…
选题榜 2026-08-17
视频选题榜 2026-08-13
· BDHCQ: InContext Learning with Recurrent Latent Reasoning · 把 ICL 与 latent reasoning 做进同一计算织物 · 150M + ARCAGI1 pass@2 29.5% / 单任务 $0.0007 把 costaccuracy Paret…
选题榜 2026-08-13
视频选题榜 2026-08-12
· Ouroboros: A SelfDeveloping Frontier Coding Agent with Reviewed Core Evolution · 自演化 Agent harness 用 review commit 治理 · round=R1 · Stealing Reasoning Traces f…
选题榜 2026-08-12
视频选题榜 2026-08-11
· SimWAM · 视频专家推理期剪枝 · 91.5 PDMS · zeroshot 迁移 nuScenes · round=R1 · HiSparse · 分层 KV 缓存扩展稀疏注意力解码 · up to 4.7× peak throughput · 已合入 SGLang 上游 · round=R2 · EvoB…
选题榜 2026-08-11
视频选题榜 2026-08-10
· RST (Recursive Synthetic Terminal Tasks) · 递归合成 37K terminalagent 任务 · 4 数量级降价到 $0.05/task · round=R1 · RoundTrip Consistency · 双向扩散单模型自检 rollout 误差 · 自监督免测量 …
选题榜 2026-08-10
推广选题榜 · 2026-08-10
基于近 30 天(2607·2608 批次)论文卡片,从「概念突破 × 话题热度 × 新近度」综合评估,Top 8 如下: ① Metis: Memory Foundation Model arxiv: 2607.26760 将 Agent 记忆从外部模块重新定义为模型原生能力——这是记忆研究方向的范式转换。传统记忆依…
选题榜 2026-08-10
视频选题榜 2026-08-09
· KVAE: Family of Tokenizers for Multimodal Generative Models · Kandinsky Lab 把音频/3D/2D 三件套 tokenizer 升级为可独立评测、跨模态统一比较的一等组件 · round=R2 · HarnessOptBench: Evalua…
选题榜 2026-08-09
视频选题榜 2026-08-08
· EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning · 同策略权重 prompt 切换扮演策略者+环境双角色,端到端优化绕开可执行环境,测试时私有预演作 CoT · rou…
选题榜 2026-08-08
视频选题榜 2026-08-07
· When Attention Goes Blind: Numerical Failure in ALiBi Positional Encodings · 位置编码线性 bias fp16/bf16 下溢导致 attention head 失明 · round=R1 · ABSeeker: Training Long…
选题榜 2026-08-07
视频选题榜 2026-08-06
· VideoDeepResearch: Towards the NextGeneration Multimodal Deepresearch Agent · 解耦 perceptionexploration pipeline + stagewise tool unlocking 强制先看视频再上网,35BA3B 64…
选题榜 2026-08-06
视频选题榜 2026-08-05
· LongHorizonHarness: Advancing LongHorizon Agents for RealWorld Tasks · LongHorizonHarness 把任务执行+状态追踪+完成评估三件混一个 context 重新建模为「外部任务状态管理问题」· MEA(ManagerExecuteAu…
选题榜 2026-08-05
视频选题榜 2026-08-04
· Keep It InMind: Benchmarking the ImplicitAssociation Blind Spot in Agent Memory · InMind 把长期记忆评测从「答对多少」推进到「该用时能不能找到」· 84.0% vs 14.4% vs ~100% 三件套 + embedding …
选题榜 2026-08-04
视频选题榜 2026-08-03
· Beyond Semantic Organization: Memory as Execution State Management for LongHorizon Agents · MAGE = 把 Agent 记忆从「语义相似度检索」重构为「分层执行状态树管理」+ Grow/Compress/Maintain/…
选题榜 2026-08-03
推广选题榜 · 2026-08-03
本周从近 30 天卡片中综合「被引 + 评审分 + SOTA + 新近度 + 话题热度」选出 Top 8。 1. User as Code:面向个性化 Agent 的可执行记忆 arxiv: 2606.16707 范式级想法:把用户记忆从「静态数据」变成「可执行代码」,Python 函数编码规则、对象承载状态,推理与执…
选题榜 2026-08-03
视频选题榜 2026-08-02
· MisKnowAgent: Is Deep Research Reliable? Misleading Knowledge Induces False Conclusions · 注入 1 篇误导文档 FCAR 平均飙升至 54.7% · 能识别 ≠ 会拒绝的工作流层失效模式 · round=R1 · Metis:…
选题榜 2026-08-02
视频选题榜 2026-08-01
· TurboVLA: RealTime VisionLanguageAction Model at 32 Hz on an RTX 4090 with <1 GB VRAM · TurboVLA 把 VLA 从 LLMcentric V→L→A 改写为 V+L→A 直接融合(DINOv3 + BERT 独立编码 + …
选题榜 2026-08-01
视频选题榜 2026-07-31
· SkillRise: Agentic Reinforcement Learning for CrossTask Skill Evolution · 跨任务技能演化训练范式 method paper · 单策略 solve+curate 双角色 + 解耦信用分配 + 跨任务测试时 scaling 现象 · round…
选题榜 2026-07-31
视频选题榜 2026-07-30
· CodeNib: A MultiView Data System for Serving Repository Context to Coding Agents · 编码 Agent 多视图仓库上下文服务 · commit 级 lexical/dense/structural 三视图 + 单一运行时 ranked …
选题榜 2026-07-30
视频选题榜 2026-07-29
· Rethinking ClassifierFree Guidance in OnPolicy Diffusion Distillation · OPD 在 CFG 开启下 branchlevel underidentification,PDM 用 branchaware matching 修正 NBA · roun…
选题榜 2026-07-29
视频选题榜 2026-07-28
· LAMAR: An Open LanguageAware Multilingual Alignment Reranker · 英文锚定 relevance 蒸馏 + 语言一致性偏好对齐修复 multilingual RAG reranker 跨语种偏好 · round=R1 · Learning on the Jo…
选题榜 2026-07-28
视频选题榜 2026-07-27
· SANAVideo 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation · 用"门控线性 + 周期 softmax 锚点 + 块级注意力残差"的混合架构,把 5B/14B 视频 DiT 推到单 H1…
选题榜 2026-07-27
推广选题榜 · 2026-07-27
综合「被引 + 评审分(星标)+ SOTA 性 + 新近度 + 话题热度」,选出以下 8 篇本周最值得推广的论文。 1. User as Code:面向个性化 Agent 的可执行记忆 arxiv: 2606.16707 为什么值得推广:提出将用户记忆从「检索对象」变为「可执行代码」的范式转变,规则直接编码为 Pyth…
选题榜 2026-07-27
视频选题榜 2026-07-26
· LLMs Get Lost in Evolving User Intent · 单轮 FullySpecified 性能无法迁移到多轮 evolvingintent 场景,各模型家族均出现显著性能下降 · round=R1 · Recurrent Sinusoidal INRs for Efficient High…
选题榜 2026-07-26
视频选题榜 2026-07-25
· SampleEfficient Learning from Agent Experience · ED 把 Agent 交互历史蒸馏进模型权重 · 保留 64.8% ICL 增益 · Direct SFT 仅 3.8% · 749 SWE + 6 文字冒险跨域验证 · 9.6× RL 样本效率 · weightle…
选题榜 2026-07-25
视频选题榜 2026-07-24
· DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations · 文档 Agent 评估方法学层 · 确定性可验证基准 + 4 原子维度 × 4 级复杂度 + 3 类失败模式 · round=R1 · Trai…
选题榜 2026-07-24
视频选题榜 2026-07-23
arxiv.org/abs/2607.19215 · HACO: Hedged Agent Computing for Reliable LLM Systems · 运行时调度层 + 乐观排序 + 保守对冲 + Experience Harvesting · round=R1 arxiv.org/abs/2607.19…
选题榜 2026-07-23