HF Daily Papers · 2026-08-29
HF Daily Papers 精选(15 篇,按社区票数排序)
- [170▲] VGI-Bench: 探测视频生成模型中的视觉智能 — https://arxiv.org/abs/2608.19583
- [163▲] VoiceMem: 面向实时交互的流式双脑记忆 — https://arxiv.org/abs/2608.26005
- [134▲] WarpSAC: 重新思考探索与利用,迈向可扩展 off-policy RL 的巅峰 — https://arxiv.org/abs/2608.24479
- [119▲] Agentic 游戏开发:作为可验证轨迹数据引擎以扩展世界模型 — https://arxiv.org/abs/2608.25518
- [107▲] JIT-Agent: 通过即时 Harness 进化扩展 Harness 智能 — https://arxiv.org/abs/2608.25593
- [74▲] PAWBench: 我们离概率对齐的世界建模还有多远? — https://arxiv.org/abs/2608.27345
- [70▲] UrbanGround: 从局部感知到真实尺度城市中的空间行动能力 — https://arxiv.org/abs/2608.27456
- [64▲] TTPO: 测试时策略优化 — https://arxiv.org/abs/2608.27448
- [56▲] Self-OPD: 无教师 Flow Matching 模型的 On-Policy 蒸馏 — https://arxiv.org/abs/2608.26872
- [55▲] 什么才是好的 Agentic 数据?从 ACE 视角看 LLM Agent 数据生成 — https://arxiv.org/abs/2608.27260
- [43▲] 让 Agent 随 Harness 共同进化:TaoLive 数字人 Agent 技术报告 — https://arxiv.org/abs/2608.15763
- [37▲] GameWAM: 面向电子游戏的世界动作模型 — https://arxiv.org/abs/2608.26200
- [25▲] PILOT in the Loop: 长 horizon Agent 的在线自我改进 — https://arxiv.org/abs/2608.26530
- [21▲] 下一片段推理 RL 真的优于 SFT 吗?在 no-CoT 数据下重新审视训练策略 — https://arxiv.org/abs/2608.23256
- [19▲] 长 horizon 音视频生成:面向持续叙事与交互式世界 — https://arxiv.org/abs/2608.23383