HF Daily Papers · 2026-07-17

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [164▲] Harness Handbook: 让持续演进的 Agent Harness 变得可读、可导航、可编辑 — https://arxiv.org/abs/2607.13285
  • [108▲] Boogu-Image-0.1: 增强开源统一多模态理解与生成 — https://arxiv.org/abs/2607.13125
  • [90▲] Function-Aware Fill-in-the-Middle: 面向代码 Agent 基础模型的中间训练方法 — https://arxiv.org/abs/2607.12463
  • [79▲] Ring-Zero: 将 Zero RL 扩展到万亿参数以实现涌现推理 — https://arxiv.org/abs/2607.12395
  • [72▲] Search Beyond What Can Be Taught: 在 Agentic 视觉生成中演化知识边界 — https://arxiv.org/abs/2607.05382
  • [70▲] Read It Back: 预训练 MLLM 是文生图的零样本奖励模型 — https://arxiv.org/abs/2607.11886
  • [63▲] SynthDocBench: 长上下文视觉文档理解的可控基准 — https://arxiv.org/abs/2607.10400
  • [46▲] 基于低重叠采集的 4D 人体-场景重建 — https://arxiv.org/abs/2607.09125
  • [44▲] KnowAct-GUIClaw: 深知笃行——具备自演化记忆与 Skill 的个人 GUI 助手 — https://arxiv.org/abs/2607.12625
  • [42▲] OvisOCR2 技术报告 — https://arxiv.org/abs/2607.13639
  • [33▲] Xiaomi-Robotics-U0: 基于世界基础模型的统一具身合成 — https://arxiv.org/abs/2607.11643
  • [30▲] PolicyShiftGuard: 策略自适应图像护栏的基准评测与改进 — https://arxiv.org/abs/2607.05910
  • [25▲] Blind-Spots-Bench: 多模态模型盲点评测 — https://arxiv.org/abs/2607.08317
  • [22▲] MetaView: 基于尺度感知隐式几何先验的单目新视角合成 — https://arxiv.org/abs/2607.12000
  • [21▲] GigaWorld-Policy-0.5: 由 AutoResearch 赋能、更快更强的 WAM — https://arxiv.org/abs/2607.13960