HF Daily Papers · 2026-09-21
HF Daily Papers 精选(15 篇,按社区票数排序)
- [371▲] LimiX-2:面向通用结构化数据智能的上下文机制网络 — https://arxiv.org/abs/2609.17488
- [135▲] DeepSeek-V4.1-Flash:突破 KV Cache 压缩的极限 — https://arxiv.org/abs/2609.19969
- [114▲] MiniMax-H3 能理解物理世界吗?一种全模态生成模型的评测 — https://arxiv.org/abs/2609.18323
- [94▲] 当 EOS token 出现分歧:理解在线策略蒸馏中的长度膨胀现象 — https://arxiv.org/abs/2609.20511
- [94▲] SoL-Pi:递归扩展自动研究循环以实现高效的 Agent 工具链 — https://arxiv.org/abs/2609.20519
- [79▲] ScienceIDE:将全球科学代码库转化为 Agent 可学习的环境 — https://arxiv.org/abs/2609.19134
- [71▲] 面向编码 Agent 的工具链设计实证研究 — https://arxiv.org/abs/2609.20804
- [65▲] 重新思考 PPO 中的 Critic 学习:理解与缓解价值扁平化 — https://arxiv.org/abs/2609.18708
- [56▲] JEPA-Anything:跨域世界的预测模型学习 — https://arxiv.org/abs/2609.20800
- [56▲] 信心源自经验:从推理到 Agent 的经验式置信度估计 — https://arxiv.org/abs/2609.17708
- [50▲] ProgramDistill:从交互式 Web 应用到可验证的参考引导式 SWE 任务 — https://arxiv.org/abs/2609.18805
- [48▲] 面向 LLM 助手的可验证社会推理 — https://arxiv.org/abs/2609.17496
- [45▲] 自演化搜索索引 — https://arxiv.org/abs/2609.19656
- [45▲] Agora:以 Git 作为集体自动研究的共享记忆 — https://arxiv.org/abs/2609.18094
- [42▲] RiskChainBench:面向混淆平台消息恢复与证据驱动网络调查的基准 — https://arxiv.org/abs/2609.16900