HF Daily Papers · 2026-07-01

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [120▲] Agentic Abstention: Agent 是否知道何时停止而非行动? — https://arxiv.org/abs/2606.28733
  • [70▲] LiveEdit: 迈向基于扩散模型的实时流式视频编辑 — https://arxiv.org/abs/2606.26740
  • [67▲] 扩展视野而非参数:以 35B Agent 达到万亿参数性能 — https://arxiv.org/abs/2606.30616
  • [44▲] TUA-Bench: 通用终端使用 Agent 基准 — https://arxiv.org/abs/2606.28480
  • [43▲] ReFreeKV: 迈向无阈值 KV Cache 压缩 — https://arxiv.org/abs/2502.16886
  • [36▲] 超越 IID:表格基础模型究竟有多通用? — https://arxiv.org/abs/2606.30410
  • [35▲] 修剪视觉世界建模评估的长尾 — https://arxiv.org/abs/2606.24256
  • [23▲] Video-MME-Logical: 视频时序逻辑推理的受控诊断基准 — https://arxiv.org/abs/2606.27828
  • [23▲] AsyncOPD: On-Policy 蒸馏能有多陈旧? — https://arxiv.org/abs/2606.24143
  • [21▲] 通过通用关键帧提取连接 VideoQA 与视频引导的 Agentic 任务 — https://arxiv.org/abs/2606.29445
  • [19▲] 一步梯度延迟并非大规模异步流水线并行 LLM 预训练的障碍 — https://arxiv.org/abs/2606.30634
  • [16▲] 一个模型,多种延迟:面向多样化实时应用的通用语音增强 — https://arxiv.org/abs/2606.25621
  • [16▲] 面向移动端 3D 高斯泼溅的蒙特卡洛能量聚合 — https://arxiv.org/abs/2606.30017
  • [15▲] OSWorld2.0: 长时序真实世界任务中的计算机使用 Agent 基准 — https://arxiv.org/abs/2606.29537
  • [15▲] TACO: 面向 Agentic 工具使用的工具增强信用优化 — https://arxiv.org/abs/2606.30251