HF Daily Papers · 2026-08-20
HF Daily Papers 精选(15 篇,按社区票数排序)
- [374▲] StateM:在 Terminal-Bench 2.1 上通过 Harness 扩展达到 95.3% 原始准确率,或 15 美元的前沿运行 — https://arxiv.org/abs/2608.15089
- [143▲] 学习剩余的,而非已掌握的:面向多奖励策略优化的饱和感知优势重加权 — https://arxiv.org/abs/2608.16072
- [137▲] 揭秘 Agent Skill:为何它们有效——直到失效 — https://arxiv.org/abs/2608.14036
- [91▲] Agentic ESOpt:以最小 GPU 需求微调长周期 LLM Agent — https://arxiv.org/abs/2608.17310
- [59▲] FreeToken:面向带宽自适应执行的边缘原生 MoE 高效服务 — https://arxiv.org/abs/2608.16157
- [58▲] Large Discovery Models:基于经验驱动的基于模型的开放式搜索 — https://arxiv.org/abs/2608.15669
- [51▲] ASI-Bench:人工智能超级智能的黎明 — https://arxiv.org/abs/2608.17271
- [44▲] Embodied-Navigator:指点、思考、记忆与对齐的高效导航 — https://arxiv.org/abs/2608.17512
- [42▲] MOSS-VL 技术报告 — https://arxiv.org/abs/2608.15045
- [38▲] AVA-Encoder:迈向 Agent 原生视频表示学习 — https://arxiv.org/abs/2608.12313
- [26▲] Agent 如何在 AutoResearch 上失败:100 个真实前沿研究任务的端到端诊断评估 — https://arxiv.org/abs/2608.14905
- [23▲] 推进开放且可复现的关系学习:RelArena-α、TabPFN-Rel 与 RPI — https://arxiv.org/abs/2608.16319
- [21▲] EDITBRIDGE:迈向忠实且高效的超高分辨率图像编辑 — https://arxiv.org/abs/2608.18063
- [19▲] HarmProfile:刻画前沿 LLM 中的有害分布 — https://arxiv.org/abs/2608.14577
- [16▲] Agent Lightning v1.0:迈向被驾驭的 Agentic RL — https://arxiv.org/abs/2608.17528