HF Daily Papers · 2026-08-08

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [212▲] 长程终局任务的递归合成 — https://arxiv.org/abs/2608.05466
  • [67▲] AgentOPSD:面向 Agentic 强化学习的递归自蒸馏 — https://arxiv.org/abs/2608.05987
  • [61▲] ABSeeker:通过答案回溯式信用分配训练长程搜索 Agent — https://arxiv.org/abs/2608.05102
  • [52▲] OSReward:为跨平台计算机使用奖励模型建立标准化评测 — https://arxiv.org/abs/2607.28609
  • [46▲] 可解释的感知语音脑磁图(MEG)解码:驱动检索的皮层源与刺激特征 — https://arxiv.org/abs/2608.01481
  • [46▲] WorldClaw:大规模 Agentic 3D 开放世界生成 — https://arxiv.org/abs/2608.05248
  • [30▲] GST-Bench:VLM 能否从视频中建立全局空间感知? — https://arxiv.org/abs/2608.05747
  • [29▲] EnvACE:通过世界预演内化环境动力学,服务于 Agentic 强化学习 — https://arxiv.org/abs/2608.06197
  • [26▲] 从失败中学习:利用困难负例实现统一多模态检索中以检索为中心的思维链(CoT) — https://arxiv.org/abs/2608.06060
  • [24▲] 从经济主体到 Agentic 经济:经济世界模型的系统蓝图 — https://arxiv.org/abs/2608.06020
  • [24▲] ChronoVision:通过潜在状态重建实现时序推理 — https://arxiv.org/abs/2608.05631
  • [24▲] GDPevo:在真实业务任务上评测 Agent 自我进化 — https://arxiv.org/abs/2608.03764
  • [22▲] Ego2Robot:从第一人称人类数据实现可扩展的机器人数据合成 — https://arxiv.org/abs/2608.02580
  • [20▲] 面向多语言数学推理的同策略(On-Policy)增量蒸馏 — https://arxiv.org/abs/2608.05802
  • [20▲] HarnessOpt-Bench:在 Harness 优化任务上评测 LLM — https://arxiv.org/abs/2608.06301