HF Daily Papers · 2026-07-09

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [72▲] RynnWorld-4D: 面向机器人操作的 4D 具身世界模型 — https://arxiv.org/abs/2607.06559
  • [71▲] AlayaWorld: 长时域可交互的视频世界生成 — https://arxiv.org/abs/2607.06291
  • [67▲] RynnWorld-Teleop: 面向数字遥操作的动作条件世界模型 — https://arxiv.org/abs/2607.06558
  • [37▲] 分层稀疏注意力的正确实现:迈向无限上下文建模 — https://arxiv.org/abs/2607.02980
  • [31▲] 以视觉作为统一的多模态生成 — https://arxiv.org/abs/2607.06560
  • [29▲] Gemma 4 技术报告 — https://arxiv.org/abs/2607.02770
  • [29▲] 将交错多模态推理桥接为统一决策过程 — https://arxiv.org/abs/2607.03748
  • [19▲] DSpark: 基于置信度调度的半自回归推测解码 — https://arxiv.org/abs/2607.05147
  • [19▲] Light-Omni: 在具备长期记忆的智能体视频理解中,以反射优于推理 — https://arxiv.org/abs/2607.05511
  • [17▲] SkillOpt-Lite: 通过一行 Vibe 实现更快更好的 Agent 自我进化 — https://arxiv.org/abs/2607.03451
  • [16▲] 面向全模态密集视频描述的并行化自回归解码 — https://arxiv.org/abs/2607.02963
  • [15▲] 三思而后行:将树搜索蒸馏为冻结 VLA 模型的动作评估 — https://arxiv.org/abs/2607.03751
  • [13▲] ACID: 通过逆动力学实现动作一致性以用于世界模型规划 — https://arxiv.org/abs/2607.02403
  • [11▲] 从基础到应用:在实践中改进 VLA 模型 — https://arxiv.org/abs/2607.06403
  • [10▲] LLM-as-a-Tutor: 面向不可验证强化学习的策略感知提示自适应 — https://arxiv.org/abs/2607.04412