HF Daily Papers · 2026-08-31
HF Daily Papers 精选(15 篇,按社区票数排序)
- [180▲] 作为可验证轨迹数据引擎的 Agentic 游戏开发,用于扩展世界模型 — https://arxiv.org/abs/2608.25518
- [173▲] VGI-Bench: 探查视频生成模型中的视觉智能 — https://arxiv.org/abs/2608.19583
- [168▲] VoiceMem: 用于实时交互的流式双脑记忆 — https://arxiv.org/abs/2608.26005
- [137▲] WarpSAC: 通过重新思考探索与利用,迈向可扩展离线策略强化学习的巅峰 — https://arxiv.org/abs/2608.24479
- [129▲] PAWBench: 我们离概率对齐的世界建模还有多远? — https://arxiv.org/abs/2608.27345
- [109▲] JIT-Agent: 通过即时 Harness 演化扩展 Harness 智能 — https://arxiv.org/abs/2608.25593
- [100▲] UrbanGround: 从局部感知到真实规模城市中的空间智能体 — https://arxiv.org/abs/2608.27456
- [73▲] TTPO: 测试时策略优化 — https://arxiv.org/abs/2608.27448
- [71▲] Self-OPD: 无需教师模型的 Flow Matching 同上策略蒸馏 — https://arxiv.org/abs/2608.26872
- [61▲] 什么是好的 Agentic 数据?从 ACE 视角看 LLM Agent 的数据生成 — https://arxiv.org/abs/2608.27260
- [46▲] 让 Agent 随 Harness 协同演化:TaoLive 数字人 Agent 技术报告 — https://arxiv.org/abs/2608.15763
- [43▲] GameWAM: 面向电子游戏的世界动作模型 — https://arxiv.org/abs/2608.26200
- [30▲] PILOT in the Loop: 长视野 Agent 的在线自我改进 — https://arxiv.org/abs/2608.26530
- [21▲] 下一块推理 RL 真的优于 SFT 吗?在无 CoT 数据下重新审视训练策略 — https://arxiv.org/abs/2608.23256
- [20▲] Open-MOPD: 多教师同上策略蒸馏中能力不平衡的诊断与修复 — https://arxiv.org/abs/2608.19098