HF Daily Papers · 2026-10-05

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [175▲] On-Policy还是Off-Policy学习?蒸馏动力学的系统研究 — https://arxiv.org/abs/2609.35259
  • [165▲] OneStreamer:统一流式视频交互中的感知、记忆与主动响应 — https://arxiv.org/abs/2610.01762
  • [69▲] Transformer过早停止思考,一个小型LoRA即可修复 — https://arxiv.org/abs/2609.36585
  • [64▲] 异构Multi-Agent LLM的无预填充跨家族KV Cache传输 — https://arxiv.org/abs/2609.32259
  • [60▲] E-MoE:面向非因子化扩散语言模型的增强型Mixture-of-Experts — https://arxiv.org/abs/2609.37533
  • [59▲] X-Tree:token化可复用经验以实现高效的Agent泛化 — https://arxiv.org/abs/2609.32993
  • [57▲] EgoTools:迈向真实世界自我中心视频中的工具中心推理 — https://arxiv.org/abs/2609.39378
  • [57▲] 让稀疏奖励发挥作用:面向多奖励RL的密度感知奖励聚合 — https://arxiv.org/abs/2610.00574
  • [55▲] 视频生成模型:后训练与对齐综述 — https://arxiv.org/abs/2610.00812
  • [55▲] InterEvolve:类人机器人运动操作中奖励程序的测试时演化 — https://arxiv.org/abs/2610.02196
  • [51▲] 去中心化Master-Mind:通过迭代意图去噪实现多智能体路径规划中的联合动作优化 — https://arxiv.org/abs/2609.32019
  • [48▲] Persona Dosing:面向分级特征控制的校准激活引导 — https://arxiv.org/abs/2609.36388
  • [45▲] 更少token,更优动作:成功率提升14%、token减少65%的GPT-6 Astra机器人Agent — https://arxiv.org/abs/2610.01939
  • [43▲] Architect-Ant:可编辑的建筑平面图自动家具布置 — https://arxiv.org/abs/2606.10953
  • [41▲] 几乎免费地更好地解码循环Transformer — https://arxiv.org/abs/2610.02185