HF Daily Papers · 2026-10-06

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [250▲] RealCompanion:通过纵向真实对话推理来基准测试人类理解能力 — https://arxiv.org/abs/2610.01780
  • [113▲] 学习蛋白质折叠能否泛化到更广泛的推理? — https://arxiv.org/abs/2609.38879
  • [89▲] MotorMind:为通用视觉语言模型构建零样本机器人操控脚手架 — https://arxiv.org/abs/2609.38078
  • [74▲] 渐进式视觉规划驱动的世界动作建模 — https://arxiv.org/abs/2610.02508
  • [74▲] 世界动作模型的视频原生动作先验学习 — https://arxiv.org/abs/2610.03391
  • [54▲] Latent-MOPD:潜在多教师同策略蒸馏 — https://arxiv.org/abs/2610.02381
  • [51▲] HyperBrowseComp:面向 Web 浏览 Agent 的多语言多模态压力测试 — https://arxiv.org/abs/2610.03574
  • [50▲] Pivot-SD:掩码扩散语言模型的高效自蒸馏 — https://arxiv.org/abs/2610.03665
  • [47▲] LexReward:面向法律语言模型的分类体系驱动奖励框架 — https://arxiv.org/abs/2609.39071
  • [45▲] SimuVerity:面向工程级 Simulink 模型生成的 Agent 基准测试 — https://arxiv.org/abs/2610.02304
  • [44▲] VeriHarness:长时任务的 Agentic 验证规模化 — https://arxiv.org/abs/2610.00972
  • [41▲] Spatial Memory Intelligence:赋予世界模型理解驱动的长期记忆 — https://arxiv.org/abs/2610.02521
  • [39▲] 多语言 GSM-Symbolic:什么决定了跨语言的能力迁移? — https://arxiv.org/abs/2610.03367
  • [37▲] Science Utopia?学术研究生态系统的闭环 LLM 模拟 — https://arxiv.org/abs/2610.01257
  • [31▲] HelixWorld:实时交互的视听世界模型 — https://arxiv.org/abs/2609.38123