推广选题榜 · 2026-08-17

本周从近 30 天入库论文中综合「被引 + 影响力被引 + 新近度 + 话题热度」精选,涵盖 Agent、AI Infra、机器人、视频多模态四大方向。


① Gemma 4 Technical Report arxiv: 2607.02770

Google 推出的新一代开源权重原生多模态模型系列,在 STEM、多模态与长上下文基准上实现显著性能跃升,人类评估任务上可比肩体量更大的前沿开源模型。本月最重磅开源模型发布之一,多模态研究必读。

📌 建议形式:深度解读


② Infinite Worlds with Versatile Interactions arxiv: 2607.07534

首次在 World Modeling 领域引入 Agentic Harness 框架:pilot agent 负责规划并执行角色行为,director agent 随场景推进动态合成新环境要素。World Model + Agent 架构融合的新范式,值得 AI 泛化研究关注。

📌 建议形式:深度解读


③ Long-Horizon-Terminal-Bench:Testing the Limits of Agents on Long-Horizon Terminal Tasks arxiv: 2607.08964

覆盖九大类共 46 个长程任务的终端 Agent 基准,含实验复现、软件工程、多模态分析、交互游戏与科学计算,并系统性分析失败模式与错误规律。长程 Agent 能力评估的稀缺基准,推动该方向后续研究。

📌 建议形式:科普 + 评测解读


④ Self-Improvements in Modern Agentic Systems: A Survey arxiv: 2607.13104

将现代自改进 Agent 建模为将经验转化为持续能力增益的自适应系统,提出由基础模型与 prompt/memory/工具/控制逻辑耦合构成的系统级框架。Agent 自我进化领域的全景综述,时效性强,适合入门级读者。

📌 建议形式:科普 / 视频


⑤ From Foundation to Application: Improving VLA Models in Practice arxiv: 2607.06403

得益于是涵盖全身自由度的扩展预训练数据,LingBot-VLA-2.0 在两个机器人平台上展现出强大的跨具身长时程移动操作能力。VLA 从理论到落地实践的代表性工作,工程参考价值高。

📌 建议形式:深度解读


⑥ RoboDojo: A Unified Sim-and-Real Benchmark for Generalist Robot Manipulation arxiv: 2607.04434

将 30 种策略集成到 XPolicyLab,在 RoboDojo 仿真-真机统一基准上评测,建立公开排行榜与系统性策略性能分析。机器人操作领域难得的统一 benchmark,适合机器人 + 泛化策略研究社群。

📌 建议形式:科普 + 视频


⑦ BDH-CQ: In-Context Learning with Recurrent Latent Reasoning arxiv: 2608.09888

将上下文学习与循环潜变量推理相结合,推理时输入持续更新循环记忆,模型在高维潜空间中迭代求解而无需外化中间推理步骤为语言。Aug 2026 最新工作,推理效率方向的新思路。

📌 建议形式:科普


⑧ Maglev: Sliding Recurrent Memory arxiv: 2608.02870

固定大小记忆的循环 Transformer 架构,在保持通用性的同时泛化滑动窗口注意力的能力。LLM Infra 中记忆效率的硬核工作,适合推理系统与长上下文优化研究社群。

📌 建议形式:深度解读