HF Daily Papers · 2026-08-15
HF Daily Papers 精选(15 篇,按社区票数排序)
- [252▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — https://arxiv.org/abs/2608.00677
- [90▲] LLMRouter:用于开发、评估和部署 LLM 路由器的统一基础设施 — https://arxiv.org/abs/2608.06867
- [82▲] Alaya-EVOKE:从线性扩展监督到无界世界 — https://arxiv.org/abs/2608.13546
- [82▲] Mechanist:将 AI 作为发现智能机制的科学仪器 — https://arxiv.org/abs/2608.12036
- [79▲] DreamX-Phi 1.0:面向机器人操作的动作条件视频世界模型 — https://arxiv.org/abs/2608.13489
- [73▲] SkillZip:面向可扩展 Agent 技能库的契约保持图压缩 — https://arxiv.org/abs/2608.05604
- [59▲] DarwinX:通过自然选择演化 Agent Harness — https://arxiv.org/abs/2608.07545
- [43▲] Intern-S2-Preview:科学 Agentic 基础模型 — https://arxiv.org/abs/2608.13505
- [39▲] 修辞手法如何对 AI 审稿人进行奖励欺骗?解析 AI 同行评审中的修辞敏感性 — https://arxiv.org/abs/2608.08975
- [33▲] PlayWorld:使用 Agent 玩家在长时目标上对世界模型进行基准测试 — https://arxiv.org/abs/2608.13552
- [32▲] AutoDesign:面向长时 Agentic 设计的元 Harness 优化 — https://arxiv.org/abs/2608.13560
- [29▲] Spatial Memory Agent:基于经验的空间智能过程记忆 — https://arxiv.org/abs/2608.12743
- [26▲] LLM Agent 能按剧本行事吗?面向交互式叙事的长时一致性基准 — https://arxiv.org/abs/2608.08160
- [17▲] 混合线性注意力大语言模型中的大规模激活:注意力前尖峰与尖峰间平台期 — https://arxiv.org/abs/2608.12149
- [15▲] Self-Geometry:面向几何一致 3D 视觉基础模型的无 GT 即插即用测试时自适应 — https://arxiv.org/abs/2608.10708