HF Daily Papers · 2026-08-07

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [55▲] ABSeeker:通过答案回溯信用分配训练长视野搜索 Agent — https://arxiv.org/abs/2608.05102
  • [45▲] ToolArtist:面向 Agentic 图像生成的工具调用统一多模态模型 — https://arxiv.org/abs/2608.04436
  • [42▲] 迈向多模态预训练的物理学:知识流、模态协同、早期统一与配方 — https://arxiv.org/abs/2608.05000
  • [37▲] 个性化幻象:LLM 如何伪造用户画像,以及自我监控为何会误导 — https://arxiv.org/abs/2608.04570
  • [28▲] OneDayAgent:迈向自主 Agent 的长视野 Harness — https://arxiv.org/abs/2608.05013
  • [21▲] GDPevo:在真实业务任务上评估 Agent 自我进化 — https://arxiv.org/abs/2608.03764
  • [20▲] 迈向 Skill-Native LLM:用于长视野推理基准测试与训练的 Skill 熵 — https://arxiv.org/abs/2608.05139
  • [19▲] 当教师产生误导时:感知虚假信号的 On-Policy 蒸馏 — https://arxiv.org/abs/2608.03632
  • [17▲] Ego2Robot:基于第一人称人类数据的可扩展机器人数据合成 — https://arxiv.org/abs/2608.02580
  • [17▲] NOLLI:用于诊断英韩性能差距的难度校准谜题基准 — https://arxiv.org/abs/2608.04397
  • [15▲] AVE-Compass:迈向音视频编辑能力的整体评估 — https://arxiv.org/abs/2607.24821
  • [14▲] MiniWorld:让视频世界模型从零训练走向普惠 — https://arxiv.org/abs/2608.01127
  • [13▲] K-EXAONE 2.0 技术报告 — https://arxiv.org/abs/2608.04505
  • [13▲] HelloWorld:在视频世界模型中实现社交交互角色 — https://arxiv.org/abs/2608.05070
  • [13▲] 解码儿童步态行为 — https://arxiv.org/abs/2608.00371