HF Daily Papers · 2026-07-05

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [71▲] Program-as-Weights:模糊函数的编程范式 — https://arxiv.org/abs/2607.02512
  • [44▲] AgenticSTS:长视野 LLM Agent 的有界记忆测试平台 — https://arxiv.org/abs/2607.02255
  • [41▲] EvoPolicyGym:交互式环境中自主策略演化的评估 — https://arxiv.org/abs/2607.02440
  • [38▲] PerceptionRubrics:将多模态评估校准到人类感知 — https://arxiv.org/abs/2606.28322
  • [37▲] 演变为混合注意力模型 — https://arxiv.org/abs/2606.30562
  • [26▲] 多分辨率流匹配:通过分阶段采样实现免训练扩散加速 — https://arxiv.org/abs/2607.01642
  • [25▲] AgenticDataBench:面向数据 Agent 的综合基准 — https://arxiv.org/abs/2607.01647
  • [24▲] ELDR:面向 PD 分离 MoE 推理服务的专家局部性感知解码路由 — https://arxiv.org/abs/2607.00466
  • [23▲] Seed2.0 Model Card:迈向真实世界复杂性的智能前沿 — https://arxiv.org/abs/2607.00248
  • [22▲] 基于非对称互变分学习的多模态连续推理 — https://arxiv.org/abs/2607.00461
  • [22▲] MemSyco-Bench:Agent 记忆中谄媚性的基准测试 — https://arxiv.org/abs/2607.01071
  • [20▲] WorldDirector:构建具备持续动态记忆的可控世界模拟器 — https://arxiv.org/abs/2607.02517
  • [18▲] ASPIRE:机器人领域的 Agentic Skill 发现 — https://arxiv.org/abs/2607.00272
  • [17▲] 打破失败级联:面向医学多模态推理的步骤感知强化学习 — https://arxiv.org/abs/2606.31825
  • [14▲] 通过 Logit 贡献评分识别非字面检索头 — https://arxiv.org/abs/2607.01002