HF Daily Papers · 2026-09-11

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [126▲] Show-Harness: 纯 VLM Agent 即可操控机器人 — https://arxiv.org/abs/2609.10522
  • [84▲] AgentGrad: 面向多 Agent 系统的干预引导提示优化 — https://arxiv.org/abs/2609.08572
  • [81▲] 可编程世界模型 — https://arxiv.org/abs/2609.10540
  • [60▲] OpenWAM: 系统化世界-动作模型预训练的开源模块化探索 — https://arxiv.org/abs/2609.07398
  • [49▲] Marigold V2: 重探用于单目深度估计的 Diffusion Transformer — https://arxiv.org/abs/2609.08084
  • [30▲] VDiff-Bench: 面向细粒度图像差异识别的挑战性基准 — https://arxiv.org/abs/2609.06245
  • [28▲] WearableQA: 真实世界可穿戴数据上的健康推理基准 — https://arxiv.org/abs/2609.05405
  • [19▲] SWE-Bench Pro Verified: 面向软件工程 Agent 的可靠基准 — https://arxiv.org/abs/2609.08149
  • [19▲] 我刚才说了什么?全双工语音模型的自监听机制 — https://arxiv.org/abs/2609.05592
  • [19▲] 机器人策略中的语言迁移度量:将希腊语加入 Cosmos3 视觉-语言-动作策略 — https://arxiv.org/abs/2609.07470
  • [16▲] SAEScientist-Bench: AI Agent 能否开展自主的 SAE 可解释性研究? — https://arxiv.org/abs/2609.09113
  • [16▲] Puppeteer: 基于物体与姿态感知的协同语音手势生成 — https://arxiv.org/abs/2609.00369
  • [16▲] SynthGait-19K: 用于步态参数估计的物理约束合成视频数据集 — https://arxiv.org/abs/2609.08108
  • [16▲] Cadence: 基于时序基础模型的误差有界需求时序有损压缩 — https://arxiv.org/abs/2609.06008
  • [15▲] 仅凭分数无法证明发现:用于审计 AI 研究 Agent 的发现认证协议 — https://arxiv.org/abs/2609.09219