HF Daily Papers · 2026-09-20
HF Daily Papers 精选(15 篇,按社区票数排序)
- [303▲] LimiX-2:面向通用结构化数据智能的上下文机制网络 — https://arxiv.org/abs/2609.17488
- [95▲] DeepSeek-V4.1-Flash:突破 KV Cache 压缩的极限 — https://arxiv.org/abs/2609.19969
- [93▲] MiniMax-H3 能推理物理世界吗?一种全模态生成模型的评估 — https://arxiv.org/abs/2609.18323
- [76▲] 当 EOS Token 出现分歧:理解 On-Policy 蒸馏中的长度膨胀现象 — https://arxiv.org/abs/2609.20511
- [74▲] ScienceIDE:将全球科学代码库转化为 Agent 可学习的环境 — https://arxiv.org/abs/2609.19134
- [69▲] SoL-Pi:递归扩展 Auto-Research 循环以实现高效的 Agent Harness — https://arxiv.org/abs/2609.20519
- [63▲] 重新思考 PPO 中的 Critic 学习:理解与缓解 Value Flattening — https://arxiv.org/abs/2609.18708
- [55▲] Coding Agent 的 Harness 设计实证研究 — https://arxiv.org/abs/2609.20804
- [54▲] 信心源于经验:从推理到 Agent 的经验性置信度估计 — https://arxiv.org/abs/2609.17708
- [48▲] ProgramDistill:从交互式 Web 应用到可验证的参考引导 SWE 任务 — https://arxiv.org/abs/2609.18805
- [43▲] Agora:作为集体 AutoResearch 共享内存的 Git — https://arxiv.org/abs/2609.18094
- [40▲] JEPA-Anything:跨域学习预测模型 — https://arxiv.org/abs/2609.20800
- [40▲] ActionPiece:重新思考自回归 Vision-Language-Action 模型的 Action Tokenization — https://arxiv.org/abs/2609.18487
- [35▲] VC-Attention:面向低比特 Attention 的 Value Smoothing 与 Softmax Casting — https://arxiv.org/abs/2609.15810
- [33▲] 面向 LLM 助手的可验证社会推理 — https://arxiv.org/abs/2609.17496