HF Daily Papers · 2026-07-28

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [142▲] AREX:面向深度研究的递归自我改进 Agent — https://arxiv.org/abs/2607.21461
  • [57▲] K12-KGraph:用于基准测试与训练教育 LLM 的课程对齐知识图谱 — https://arxiv.org/abs/2605.09635
  • [50▲] ReferTrack:先指代后跟踪的具身视觉跟踪 — https://arxiv.org/abs/2607.20061
  • [44▲] 视觉对比自蒸馏 — https://arxiv.org/abs/2607.21556
  • [40▲] DataPrep-Bench:将 LLM 作为训练数据准备者的基准测试 — https://arxiv.org/abs/2607.20465
  • [35▲] Show, Don't Tell:在生成像素而非 LLM 文本中评估空间认知 — https://arxiv.org/abs/2607.21072
  • [34▲] SANA-Video 2.0:采用注意力残差的混合线性注意力高效视频生成 — https://arxiv.org/abs/2607.21553
  • [30▲] Skill 自博弈:通过技能协同进化拓展 LLM 能力边界 — https://arxiv.org/abs/2607.22529
  • [28▲] NVIDIA-labs OO Agents:原生 Python 面向对象 Agent — https://arxiv.org/abs/2607.20709
  • [25▲] 主动观察者的考试 — https://arxiv.org/abs/2607.16165
  • [24▲] Molt:面向 Agent 强化学习的可扩展 PyTorch 原生训练框架 — https://arxiv.org/abs/2607.21653
  • [24▲] Tencent WorkBuddy Bench:抗污染任务构建的多领域编码 Agent 基准 — https://arxiv.org/abs/2607.20911
  • [22▲] LLM 在不断演化的用户意图中迷失 — https://arxiv.org/abs/2607.20734
  • [19▲] 通过相机-显示器耦合实现颜色透传 — https://arxiv.org/abs/2607.12746
  • [18▲] 从视频中自监督学习结构化动力学 — https://arxiv.org/abs/2607.21576