HF Daily Papers · 2026-08-17

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [253▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — https://arxiv.org/abs/2608.00677
  • [116▲] Alaya-EVOKE:从线性扩展监督到无尽世界 — https://arxiv.org/abs/2608.13546
  • [102▲] LLMRouter:用于开发、评估和部署 LLM 路由器的统一基础设施 — https://arxiv.org/abs/2608.06867
  • [91▲] DreamX-Phi 1.0:面向机器人操控的动作条件视频世界模型 — https://arxiv.org/abs/2608.13489
  • [84▲] DarwinX:通过自然选择进化 Agent Harness — https://arxiv.org/abs/2608.07545
  • [84▲] Mechanist:作为发现智能机制科学仪器的 AI — https://arxiv.org/abs/2608.12036
  • [74▲] SkillZip:用于可扩展 Agent Skill 库的契约保持型图压缩 — https://arxiv.org/abs/2608.05604
  • [54▲] Intern-S2-Preview:科学 Agentic 基础模型 — https://arxiv.org/abs/2608.13505
  • [47▲] 修辞如何奖励破解 AI 评审?剖析 AI 同行评审中的修辞敏感性 — https://arxiv.org/abs/2608.08975
  • [43▲] AutoDesign:面向长周期 Agentic 设计的 Meta-Harness 优化 — https://arxiv.org/abs/2608.13560
  • [42▲] PlayWorld:通过 Agent 玩家对长周期目标进行世界模型基准测试 — https://arxiv.org/abs/2608.13552
  • [40▲] Spatial Memory Agent:面向空间智能的以经验为依据的过程记忆 — https://arxiv.org/abs/2608.12743
  • [28▲] 混合线性注意力大语言模型中的大规模激活:注意力前的尖峰与尖峰间的平台 — https://arxiv.org/abs/2608.12149
  • [27▲] LLM Agent 能坚守剧本吗?面向交互叙事中长周期一致性的基准测试 — https://arxiv.org/abs/2608.08160
  • [21▲] LiveAnimate:实时稳定的长时间流式人体动画 — https://arxiv.org/abs/2608.11745