HF Daily Papers · 2026-10-09
HF Daily Papers 精选(15 篇,按社区票数排序)
- [100▲] STEPQuant:Delta 规则循环状态量化中何时何处出错 — https://arxiv.org/abs/2609.38169
- [62▲] UltraText Bench:面向图像生成中文本渲染评测的大规模双语基准 — https://arxiv.org/abs/2610.09823
- [53▲] VepAgent:通过工具化强化学习桥接因果-VEPD转换的视频事件预测 — https://arxiv.org/abs/2610.06293
- [48▲] UniWam:统一世界-动作模型 — https://arxiv.org/abs/2610.02054
- [35▲] Tetris3D:物体可拼合的 3D 场景生成 — https://arxiv.org/abs/2610.10539
- [34▲] RunningTab:通过环境侧 Tab 实现直接工作区交互 — https://arxiv.org/abs/2610.10444
- [29▲] RobotWorld:面向多任务、多本体的多模态 Agent 机器人使用评测基准 — https://arxiv.org/abs/2610.10409
- [27▲] On-Policy 蒸馏的收益与坍缩:一种强化学习视角 — https://arxiv.org/abs/2610.03185
- [26▲] PhysEvo: Astra Can Act, Let It — https://arxiv.org/abs/2610.08995
- [25▲] SWE-Game:编码 Agent 能构建我们想要的游戏吗? — https://arxiv.org/abs/2609.33678
- [19▲] NAMVIS:下一尺度自回归多视角图像合成 — https://arxiv.org/abs/2610.04722
- [16▲] 带标量伴随匹配的 Q 学习 — https://arxiv.org/abs/2610.10437
- [16▲] 从 Pareto 到偏好:通过摊销 Agent 策略发现的个性化测试时推理 — https://arxiv.org/abs/2610.09684
- [14▲] 自回溯蒸馏:将事后经验转化为先验远见 — https://arxiv.org/abs/2610.08077
- [12▲] QuadTok:用于自回归图像生成的四叉树视觉分词器 — https://arxiv.org/abs/2610.10497