推广选题榜 · 2026-07-13
选自近 30 天 paper_cards,重点考量:被引、影响力被引、⭐评级、新近度、话题热度。控制 800 字内。
1. Qwen-RobotManip · arxiv: 2606.17846
对齐释放机器人操作基础模型的规模化潜力
- 被引 8 | 影响力被引 2 | RoboChallenge 第1(SOTA)| 真实机器人验证
- 推广理由:被引量级碾压同期工作,RoboChallenge 排名第一且有真实硬件验证,是具身智能从实验室走向落地的重要信号。
- 建议形式:深度解读
2. MemStrata · arxiv: 2606.26511
检索记忆中的时效性:消除 AI 智能体在演化知识上的过时事实错误
- RAG 有 15–40% 的概率输出已被取代的旧值;MemStrata 将其降至约 0%
- 推广理由:揭示了 RAG 体系中一个被忽视的系统性失效,结论触目惊心,对所有依赖 RAG 的 Agent 系统有直接警示意义。
- 建议形式:科普 + 深度解读
3. MRAgent · arxiv: 2606.06036
记忆是被重构而非被检索的
- ⭐⭐⭐⭐⭐ | 联想记忆图 + 主动重构 | MemoryArena 任务成功率提升 7.8–20.4%
- 推广理由:"记忆即重构"的核心洞察挑战了主流检索范式,方法论上具有范式级别的启发性,且有量化收益支撑。
- 建议形式:深度解读
4. OpenComputer · arxiv: 2605.19769
面向 Computer-Use Agents 的可验证软件世界
- ⭐⭐⭐⭐⭐ | 被引 3 | 硬编码验证器 vs LLM-as-Judge 对比研究
- 推广理由:解决了 Agent 评估中最核心的"谁来判定成功"问题,在 computer-use 赛道持续火热的背景下极具工程落地价值。
- 建议形式:深度解读
5. SHIFT · arxiv: 2606.27786
门控调制激活引导:RAG 中知识冲突的神经元级解决方案
- 将神经元级修改重构为可学习的门控调制,LLM 自适应调节内部激活
- 推广理由:知识冲突是 RAG 落地的核心痛点,SHIFT 从激活层面给出通用解法,思路新颖且免训练。
- 建议形式:深度解读
6. π-Bench · arxiv: 2605.14678
长周期工作流中的主动式个人助手 Agent 基准
- ⭐⭐⭐⭐⭐ | 被引 1 | 评估 Agent 预见并满足隐含需求的能力
- 推广理由:率先提出"主动性"与"任务完成度"联合评估框架,填补了个人助手 Agent 评估体系的空白。
- 建议形式:科普
7. Linear Attention Architectures · arxiv: 2607.07953
线性注意力架构:机制、权衡与跨层路由
- 对 softmax + 四种循环线性注意力架构的首次系统对比
- 推广理由:infra 侧最基础的选择问题之一,有望替代 Transformer 中 softmax 注意力,工程影响面极广。
- 建议形式:视频 / 深度解读
8. Agentic Abstention · arxiv: 2606.28733
Agent 是否知道何时该停止而非行动?
- 发现更大/更强的模型有时在及时弃答上反而更差
- 推广理由:结论反直觉,触及 Agent 可靠性评估中最被忽视的维度——"知道边界"比"能做什么"更难,对安全部署有直接价值。
- 建议形式:科普