HF Daily Papers · 2026-10-03
HF Daily Papers 精选(15 篇,按社区票数排序)
- [146▲] OneStreamer: 在流式视频交互中统一感知、记忆与主动响应 — https://arxiv.org/abs/2610.01762
- [114▲] On-Policy 还是 Off-Policy 学习?蒸馏动力学的系统性研究 — https://arxiv.org/abs/2609.35259
- [49▲] E-MoE: 面向非因子化扩散语言模型的增强 Mixture-of-Experts — https://arxiv.org/abs/2609.37533
- [42▲] 让稀疏奖励发挥作用:面向多奖励 RL 的密度感知奖励聚合 — https://arxiv.org/abs/2610.00574
- [36▲] Decentralized Master-Mind: 在多智能体路径规划中通过迭代意图去噪实现联合动作精炼 — https://arxiv.org/abs/2609.32019
- [36▲] InterEvolve: 面向人形机器人 loco-manipulation 的奖励程序测试时演化 — https://arxiv.org/abs/2610.02196
- [34▲] EgoTools: 迈向真实世界自我中心视频中的工具中心推理 — https://arxiv.org/abs/2609.39378
- [24▲] 更少 token、更优动作:GPT-6 Astra 机器人 Agent,成功率提升 14% 且 token 减少 65% — https://arxiv.org/abs/2610.01939
- [19▲] 几乎免费地更好地解码循环 Transformer — https://arxiv.org/abs/2610.02185
- [18▲] SILSA: 面向拓扑保持的高分辨率 3D 生成的滑动窗口切片潜变量 — https://arxiv.org/abs/2610.02201
- [17▲] Multimodal Flow: 嵌入空间中语言与视觉的统一流建模 — https://arxiv.org/abs/2609.40362
- [17▲] Argo-Bench: 在企业级工作流上评估数据 Agent — https://arxiv.org/abs/2610.02122
- [16▲] CorrGRPO: 面向多奖励学习的相关性归一化 GRPO — https://arxiv.org/abs/2609.36820
- [12▲] X-Tree: 通过 token 化可复用经验实现高效的 Agent 泛化 — https://arxiv.org/abs/2609.32993
- [12▲] PhysVista: 通过 VLM 的感知-推理-评估循环对物理智能进行基准测试 — https://arxiv.org/abs/2610.00559