HF Daily Papers · 2026-08-04
HF Daily Papers 精选(15 篇,按社区票数排序)
- [294▲] Qwen-UI-Agent Technical Report:迈向面向下一代以真实世界为中心的基础 GUI Agent — https://arxiv.org/abs/2607.28227
- [73▲] 从 RLVR 到 RLSVR:任务变换诱导开放域 LLM 自我提升的可自验证奖励 — https://arxiv.org/abs/2607.23802
- [53▲] 心智世界建模 — https://arxiv.org/abs/2607.27201
- [51▲] Memory Decoder at Scale:一种预训练参数化长期记忆 — https://arxiv.org/abs/2607.27919
- [50▲] N_0-VTLA:使用潜在触觉 token 扩展视觉-触觉-语言-动作模型 — https://arxiv.org/abs/2607.23782
- [48▲] Beacon:知道何时以及如何执行 Agent 式视觉推理 — https://arxiv.org/abs/2607.28595
- [41▲] Meshy T2:基于 Flow Matching 的快速原生网格生成 — https://arxiv.org/abs/2607.28675
- [37▲] MPIE-Bench:解剖学合理的多人交互编辑基准 — https://arxiv.org/abs/2607.27616
- [32▲] 超越借用历史:面向交互式角色扮演评估的人物对齐用户模拟 — https://arxiv.org/abs/2607.27816
- [31▲] AISPA:面向 LLM 应用的用户中心系统提示审计 — https://arxiv.org/abs/2607.28617
- [28▲] N_0-TWAM:扩展面向接触丰富操作的触觉原生世界-动作模型 — https://arxiv.org/abs/2607.23783
- [26▲] RefCaptioner:多参考图像锚定的视频字幕生成 — https://arxiv.org/abs/2607.28509
- [24▲] 视觉生成中文本条件的缩放特性 — https://arxiv.org/abs/2607.29679
- [24▲] QQWorld:用于世界模型正则化的分位数-分位数匹配 — https://arxiv.org/abs/2607.28415
- [23▲] SAF-OPD:面向 On-Policy 蒸馏的稳定优势融合 — https://arxiv.org/abs/2607.29209