HF Daily Papers · 2026-08-15

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [252▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — https://arxiv.org/abs/2608.00677
  • [90▲] LLMRouter:用于开发、评估和部署 LLM 路由器的统一基础设施 — https://arxiv.org/abs/2608.06867
  • [82▲] Alaya-EVOKE:从线性扩展监督到无界世界 — https://arxiv.org/abs/2608.13546
  • [82▲] Mechanist:将 AI 作为发现智能机制的科学仪器 — https://arxiv.org/abs/2608.12036
  • [79▲] DreamX-Phi 1.0:面向机器人操作的动作条件视频世界模型 — https://arxiv.org/abs/2608.13489
  • [73▲] SkillZip:面向可扩展 Agent 技能库的契约保持图压缩 — https://arxiv.org/abs/2608.05604
  • [59▲] DarwinX:通过自然选择演化 Agent Harness — https://arxiv.org/abs/2608.07545
  • [43▲] Intern-S2-Preview:科学 Agentic 基础模型 — https://arxiv.org/abs/2608.13505
  • [39▲] 修辞手法如何对 AI 审稿人进行奖励欺骗?解析 AI 同行评审中的修辞敏感性 — https://arxiv.org/abs/2608.08975
  • [33▲] PlayWorld:使用 Agent 玩家在长时目标上对世界模型进行基准测试 — https://arxiv.org/abs/2608.13552
  • [32▲] AutoDesign:面向长时 Agentic 设计的元 Harness 优化 — https://arxiv.org/abs/2608.13560
  • [29▲] Spatial Memory Agent:基于经验的空间智能过程记忆 — https://arxiv.org/abs/2608.12743
  • [26▲] LLM Agent 能按剧本行事吗?面向交互式叙事的长时一致性基准 — https://arxiv.org/abs/2608.08160
  • [17▲] 混合线性注意力大语言模型中的大规模激活:注意力前尖峰与尖峰间平台期 — https://arxiv.org/abs/2608.12149
  • [15▲] Self-Geometry:面向几何一致 3D 视觉基础模型的无 GT 即插即用测试时自适应 — https://arxiv.org/abs/2608.10708