HF Daily Papers · 2026-06-30

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [57▲] 面向机器人控制的上下文世界建模 — https://arxiv.org/abs/2606.26025
  • [49▲] OPID:面向 Agentic 强化学习的 On-Policy 技能蒸馏 — https://arxiv.org/abs/2606.26790
  • [43▲] 验证的边界:Coding Agent 奖励没有银弹 — https://arxiv.org/abs/2606.26300
  • [39▲] PhysisForcing:面向机器人操作的物理增强世界模拟器 — https://arxiv.org/abs/2606.28128
  • [38▲] ViQ:任意分辨率下文本对齐的视觉量化表示 — https://arxiv.org/abs/2606.27313
  • [37▲] 形式化潜在思维:LLM 中思维表示的四条公理 — https://arxiv.org/abs/2606.27378
  • [33▲] 作为桥接动作的翻译:将操作技能从人类迁移到机器人 — https://arxiv.org/abs/2606.28133
  • [32▲] JetSpec:通过并行树形 Drafting 突破投机解码的扩展天花板 — https://arxiv.org/abs/2606.18394
  • [28▲] Qwen-Image-2.0-RL 技术报告 — https://arxiv.org/abs/2606.27608
  • [28▲] GUI vs. CLI:纯屏幕与 Skill 中介的 Computer-Use Agent 中的执行瓶颈 — https://arxiv.org/abs/2606.24551
  • [25▲] Fast LeWorldModel — https://arxiv.org/abs/2606.26217
  • [18▲] 穿越重重考验:重新评估 Agent 在熟悉环境之外的能力 — https://arxiv.org/abs/2606.14397
  • [16▲] MultiHashFormer:基于哈希的生成式语言模型 — https://arxiv.org/abs/2606.28057
  • [16▲] 多步 Tool-Use 强化学习为何崩溃以及监督信号如何修复 — https://arxiv.org/abs/2606.26027
  • [13▲] LISA:面向视觉条件可控生成的似然分数对齐 — https://arxiv.org/abs/2606.27192