HF Daily Papers · 2026-08-10
HF Daily Papers 精选(15 篇,按社区票数排序)
- [223▲] 递归合成用于长周期终局任务 — https://arxiv.org/abs/2608.05466
- [85▲] AgentOPSD:面向 Agentic 强化学习的递归自蒸馏 — https://arxiv.org/abs/2608.05987
- [67▲] OSReward:为跨平台计算机使用 Reward Model 建立标准化评测 — https://arxiv.org/abs/2607.28609
- [65▲] 可解释的 MEG 感知语音解码:驱动检索的皮层源与刺激特征 — https://arxiv.org/abs/2608.01481
- [63▲] ABSeeker:通过答案回溯信用分配训练长周期搜索 Agent — https://arxiv.org/abs/2608.05102
- [59▲] WorldClaw:大规模 Agentic 3D 开放世界生成 — https://arxiv.org/abs/2608.05248
- [42▲] GST-Bench:VLM 能否从视频中建立全局空间感知? — https://arxiv.org/abs/2608.05747
- [38▲] EnvACE:通过世界预演内化环境动力学以用于 Agentic 强化学习 — https://arxiv.org/abs/2608.06197
- [37▲] 从失败中学习:面向统一多模态检索的以检索为中心的难负例思维链 — https://arxiv.org/abs/2608.06060
- [37▲] ChronoVision:通过潜状态重建实现时间推理 — https://arxiv.org/abs/2608.05631
- [33▲] HarnessOpt-Bench:在 Harness 优化任务上评测 LLM — https://arxiv.org/abs/2608.06301
- [32▲] 从经济 Agent 到 Agentic 经济:面向经济世界模型的系统蓝图 — https://arxiv.org/abs/2608.06020
- [30▲] DataSpace:在异构工作空间上对可验证分析的数据 Agent 基准评测 — https://arxiv.org/abs/2608.03451
- [29▲] 教 Nemotron 学希腊语:跨专业领域挖掘语料、适配检索并 grounding 生成的现代希腊语实践 — https://arxiv.org/abs/2608.05138
- [28▲] 面向多语言数学推理的 On-Policy Delta 蒸馏 — https://arxiv.org/abs/2608.05802