HF Daily Papers · 2026-07-17
HF Daily Papers 精选(15 篇,按社区票数排序)
- [164▲] Harness Handbook: 让持续演进的 Agent Harness 变得可读、可导航、可编辑 — https://arxiv.org/abs/2607.13285
- [108▲] Boogu-Image-0.1: 增强开源统一多模态理解与生成 — https://arxiv.org/abs/2607.13125
- [90▲] Function-Aware Fill-in-the-Middle: 面向代码 Agent 基础模型的中间训练方法 — https://arxiv.org/abs/2607.12463
- [79▲] Ring-Zero: 将 Zero RL 扩展到万亿参数以实现涌现推理 — https://arxiv.org/abs/2607.12395
- [72▲] Search Beyond What Can Be Taught: 在 Agentic 视觉生成中演化知识边界 — https://arxiv.org/abs/2607.05382
- [70▲] Read It Back: 预训练 MLLM 是文生图的零样本奖励模型 — https://arxiv.org/abs/2607.11886
- [63▲] SynthDocBench: 长上下文视觉文档理解的可控基准 — https://arxiv.org/abs/2607.10400
- [46▲] 基于低重叠采集的 4D 人体-场景重建 — https://arxiv.org/abs/2607.09125
- [44▲] KnowAct-GUIClaw: 深知笃行——具备自演化记忆与 Skill 的个人 GUI 助手 — https://arxiv.org/abs/2607.12625
- [42▲] OvisOCR2 技术报告 — https://arxiv.org/abs/2607.13639
- [33▲] Xiaomi-Robotics-U0: 基于世界基础模型的统一具身合成 — https://arxiv.org/abs/2607.11643
- [30▲] PolicyShiftGuard: 策略自适应图像护栏的基准评测与改进 — https://arxiv.org/abs/2607.05910
- [25▲] Blind-Spots-Bench: 多模态模型盲点评测 — https://arxiv.org/abs/2607.08317
- [22▲] MetaView: 基于尺度感知隐式几何先验的单目新视角合成 — https://arxiv.org/abs/2607.12000
- [21▲] GigaWorld-Policy-0.5: 由 AutoResearch 赋能、更快更强的 WAM — https://arxiv.org/abs/2607.13960