HF Daily Papers · 2026-09-22

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [146▲] DeepSeek-V4.1-Flash:突破 KV Cache 压缩的极限 — https://arxiv.org/abs/2609.19969
  • [116▲] MiniMax-H3 能推理物理世界吗?Omni-Modal 生成模型评测 — https://arxiv.org/abs/2609.18323
  • [96▲] EOS Token 意见分歧:理解 On-Policy 蒸馏中的长度膨胀现象 — https://arxiv.org/abs/2609.20511
  • [90▲] IntBMoE:将块级条件融入专家组合,实现全参与 Mixture-of-Experts — https://arxiv.org/abs/2609.21346
  • [88▲] CodeMidas:从代码本身扩展 Agentic 编码 RL 环境 — https://arxiv.org/abs/2609.22068
  • [86▲] 基于代码的大规模可落地 Skill 合成,面向 Agentic 智能 — https://arxiv.org/abs/2609.05571
  • [69▲] EvoOntology:面向 Data Agent 的自演化 Ontology 层 — https://arxiv.org/abs/2609.15779
  • [60▲] RecreationWorld:面向混合 Computer-Use Agent 的可扩展且可验证环境 — https://arxiv.org/abs/2609.22000
  • [58▲] JEPA-Anything:跨世界的预测模型学习 — https://arxiv.org/abs/2609.20800
  • [51▲] LLM 助手的可验证社会推理 — https://arxiv.org/abs/2609.17496
  • [47▲] 自演化搜索索引 — https://arxiv.org/abs/2609.19656
  • [41▲] RetireOPD:面向 Agentic 强化学习的自退出 On-Policy 蒸馏 — https://arxiv.org/abs/2609.20784
  • [38▲] 反思、修订、复用:GUI Agent 的免训练 Skill 演化 — https://arxiv.org/abs/2609.17653
  • [35▲] WeVisDoc:从覆盖到能力,构建鲁棒的端到端文档解析 — https://arxiv.org/abs/2609.20423
  • [34▲] Video DeltaNet:面向直播视频生成的 Video-Native 混合注意力 — https://arxiv.org/abs/2609.20744