HF Daily Papers · 2026-07-09
HF Daily Papers 精选(15 篇,按社区票数排序)
- [72▲] RynnWorld-4D: 面向机器人操作的 4D 具身世界模型 — https://arxiv.org/abs/2607.06559
- [71▲] AlayaWorld: 长时域可交互的视频世界生成 — https://arxiv.org/abs/2607.06291
- [67▲] RynnWorld-Teleop: 面向数字遥操作的动作条件世界模型 — https://arxiv.org/abs/2607.06558
- [37▲] 分层稀疏注意力的正确实现:迈向无限上下文建模 — https://arxiv.org/abs/2607.02980
- [31▲] 以视觉作为统一的多模态生成 — https://arxiv.org/abs/2607.06560
- [29▲] Gemma 4 技术报告 — https://arxiv.org/abs/2607.02770
- [29▲] 将交错多模态推理桥接为统一决策过程 — https://arxiv.org/abs/2607.03748
- [19▲] DSpark: 基于置信度调度的半自回归推测解码 — https://arxiv.org/abs/2607.05147
- [19▲] Light-Omni: 在具备长期记忆的智能体视频理解中,以反射优于推理 — https://arxiv.org/abs/2607.05511
- [17▲] SkillOpt-Lite: 通过一行 Vibe 实现更快更好的 Agent 自我进化 — https://arxiv.org/abs/2607.03451
- [16▲] 面向全模态密集视频描述的并行化自回归解码 — https://arxiv.org/abs/2607.02963
- [15▲] 三思而后行:将树搜索蒸馏为冻结 VLA 模型的动作评估 — https://arxiv.org/abs/2607.03751
- [13▲] ACID: 通过逆动力学实现动作一致性以用于世界模型规划 — https://arxiv.org/abs/2607.02403
- [11▲] 从基础到应用:在实践中改进 VLA 模型 — https://arxiv.org/abs/2607.06403
- [10▲] LLM-as-a-Tutor: 面向不可验证强化学习的策略感知提示自适应 — https://arxiv.org/abs/2607.04412