推广选题榜 · 2026-08-03
本周从近 30 天卡片中综合「被引 + 评审分 + SOTA + 新近度 + 话题热度」选出 Top 8。
1. User as Code:面向个性化 Agent 的可执行记忆
arxiv: 2606.16707
范式级想法:把用户记忆从「静态数据」变成「可执行代码」,Python 函数编码规则、对象承载状态,推理与执行在同一媒介完成。为个性化 Agent 的记忆架构打开新思路,且代码已开源,值得向工程社区强推。 建议形式:深度解读
2. Agents' Last Exam(ALE):弥合基准与真实经济价值
arxiv: 2606.05405
4 citations / 2 influence citations,领先其他候选一个量级。首次提出「基准表现 → GDP 相关影响」的系统性评测框架,填补了 agent 大面积刷榜但落地效果存疑的空白。目标读者广,适合科普向传播。 建议形式:科普 + 视频
3. Directory-Aware Query:向量数据库的目录语义一等公民
arxiv: 2606.16903
首次将目录拓扑作为向量数据库原生能力,而非扁平元数据补丁。解决企业知识库、代码仓库、Agent 记忆中的层级检索痛点,发表在 ACL 2026前夕,工程价值明确,适合面向开发者社区推广。 建议形式:深度解读
4. PathRouter:GraphRAG 中的奖励与检索质量对齐
arxiv: 2606.16409
揭示 GraphRAG agent 中 reward aliasing 和 search-update ambiguity 两大根本问题,提出路径感知 GRPO 训练框架抑制捷径、强化证据寻求行为。GraphRAG 方向持续高热,方法论严谨,适合技术社区。 建议形式:深度解读
5. Lost at the End:多模态检索增强问答中的首因偏差
arxiv: 2606.16494
首次受控探查发现多模态 KB-VQA 同样存在 primacy bias,recall@k 并非正确评测指标。对多模态 Agent 的提示设计和上下文排序策略有直接工程指导意义,position paper 体量,传播效率高。 建议形式:科普
6. SwiftCache:跨模型 KV Cache 共享突破 HBM 瓶颈
arxiv: 2606.16135
多轮 Agent 对话中 KV cache 卸载是系统工程难题,SwiftCache 通过 NVLink 异构共享避免 PCIe 瓶颈,支持更长对话轮数。LLM-infra 方向工程受众稳定,方法清晰,适合系统向解读。 建议形式:深度解读
7. V-RAGBench:视频检索增强的解耦评测基准
arxiv: 2606.13141
首个视频 RAG 评测基准,解耦检索与生成评价,提供 CARVE 自适应配置方法。随着视频理解需求上升,视频 RAG 将成下一个工程热点,先发推广价值大。 建议形式:科普 + 视频
8. ContextRL:上下文感知强化学习提升多模态长推理
arxiv: 2606.17053
通过间接辅助目标而非直接数据增强提升长周期推理与多模态性能,思路反直觉但有效。Princeton + UC Davis 联合团队,RL + 多模态 + Agent 三重热点叠加,新鲜度高。 建议形式:深度解读