HF Daily Papers · 2026-09-22
HF Daily Papers 精选(15 篇,按社区票数排序)
- [146▲] DeepSeek-V4.1-Flash:突破 KV Cache 压缩的极限 — https://arxiv.org/abs/2609.19969
- [116▲] MiniMax-H3 能推理物理世界吗?Omni-Modal 生成模型评测 — https://arxiv.org/abs/2609.18323
- [96▲] EOS Token 意见分歧:理解 On-Policy 蒸馏中的长度膨胀现象 — https://arxiv.org/abs/2609.20511
- [90▲] IntBMoE:将块级条件融入专家组合,实现全参与 Mixture-of-Experts — https://arxiv.org/abs/2609.21346
- [88▲] CodeMidas:从代码本身扩展 Agentic 编码 RL 环境 — https://arxiv.org/abs/2609.22068
- [86▲] 基于代码的大规模可落地 Skill 合成,面向 Agentic 智能 — https://arxiv.org/abs/2609.05571
- [69▲] EvoOntology:面向 Data Agent 的自演化 Ontology 层 — https://arxiv.org/abs/2609.15779
- [60▲] RecreationWorld:面向混合 Computer-Use Agent 的可扩展且可验证环境 — https://arxiv.org/abs/2609.22000
- [58▲] JEPA-Anything:跨世界的预测模型学习 — https://arxiv.org/abs/2609.20800
- [51▲] LLM 助手的可验证社会推理 — https://arxiv.org/abs/2609.17496
- [47▲] 自演化搜索索引 — https://arxiv.org/abs/2609.19656
- [41▲] RetireOPD:面向 Agentic 强化学习的自退出 On-Policy 蒸馏 — https://arxiv.org/abs/2609.20784
- [38▲] 反思、修订、复用:GUI Agent 的免训练 Skill 演化 — https://arxiv.org/abs/2609.17653
- [35▲] WeVisDoc:从覆盖到能力,构建鲁棒的端到端文档解析 — https://arxiv.org/abs/2609.20423
- [34▲] Video DeltaNet:面向直播视频生成的 Video-Native 混合注意力 — https://arxiv.org/abs/2609.20744