HF Daily Papers · 2026-07-04

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [56▲] Program-as-Weights:面向模糊函数的编程范式 — https://arxiv.org/abs/2607.02512
  • [39▲] EvoPolicyGym:在交互式环境中评估自主策略演化 — https://arxiv.org/abs/2607.02440
  • [39▲] AgenticSTS:面向长时程 LLM Agent 的有界内存测试平台 — https://arxiv.org/abs/2607.02255
  • [36▲] PerceptionRubrics:将多模态评估校准至人类感知 — https://arxiv.org/abs/2606.28322
  • [30▲] 变形为混合注意力模型 — https://arxiv.org/abs/2606.30562
  • [23▲] ELDR:用于 PD 分离式 MoE 推理服务的专家局部性感知解码路由 — https://arxiv.org/abs/2607.00466
  • [23▲] Seed2.0 Model Card:迈向真实世界复杂性的智能前沿 — https://arxiv.org/abs/2607.00248
  • [22▲] 基于非对称互变分学习的多模态连续推理 — https://arxiv.org/abs/2607.00461
  • [22▲] MemSyco-Bench:评估 Agent 记忆中的谄媚性 — https://arxiv.org/abs/2607.01071
  • [21▲] 多分辨率流匹配:通过分阶段采样实现免训练扩散加速 — https://arxiv.org/abs/2607.01642
  • [21▲] AgenticDataBench:面向数据 Agent 的综合基准 — https://arxiv.org/abs/2607.01647
  • [16▲] WorldDirector:通过持久动态记忆构建可控世界模拟器 — https://arxiv.org/abs/2607.02517
  • [16▲] ASPIRE:面向机器人的 Agentic /Skills 发现 — https://arxiv.org/abs/2607.00272
  • [14▲] 打破失败级联:用于医学多模态推理的步骤感知强化学习 — https://arxiv.org/abs/2606.31825
  • [13▲] SkillCoach:用于评估与增强 Agentic Skill 使用的自演化评分标准 — https://arxiv.org/abs/2607.01874