HF Daily Papers · 2026-09-01
HF Daily Papers 精选(15 篇,按社区票数排序)
- [185▲] Agentic游戏开发:作为扩展世界模型的可验证轨迹数据引擎 — https://arxiv.org/abs/2608.25518
- [138▲] PAWBench:我们距离概率对齐的世界建模还有多远? — https://arxiv.org/abs/2608.27345
- [106▲] UrbanGround:从局部感知到真实尺度城市中的空间主动性 — https://arxiv.org/abs/2608.27456
- [87▲] LoopArena:将模型作为循环工程的运行时控制器进行基准测试 — https://arxiv.org/abs/2608.28281
- [72▲] TTPO:测试时策略优化 — https://arxiv.org/abs/2608.27448
- [67▲] 超越数据扩展:以表征为中心的视觉-语言-动作模型持续预训练 — https://arxiv.org/abs/2608.27550
- [61▲] DART-SD:面向多轮工具调用Agent自蒸馏的钻石拓扑感知检索与调优 — https://arxiv.org/abs/2608.18524
- [52▲] Agentic制品创建:系统、评估、原则与机遇 — https://arxiv.org/abs/2608.28122
- [47▲] 让Agent与其测试框架协同进化:TaoLive数字人Agent技术报告 — https://arxiv.org/abs/2608.15763
- [45▲] GameWAM:面向视频游戏的世界动作模型 — https://arxiv.org/abs/2608.26200
- [43▲] 以代码为世界:面向物理推理的可执行世界表征的Agentic发现 — https://arxiv.org/abs/2608.27549
- [35▲] J-Zero:从零数据出发的统一挑战者-求解者-评判者协同进化 — https://arxiv.org/abs/2608.26582
- [30▲] PILOT in the Loop:面向长视野Agent的在线自我改进 — https://arxiv.org/abs/2608.26530
- [28▲] 重新审视长视野流式三维重建中的局部上下文 — https://arxiv.org/abs/2608.27529
- [27▲] Puro-2B:Poor Lab在RTX 5090上以5090美元预算训练的Qwen2-1.5B模型 — https://arxiv.org/abs/2608.27370