HF Daily Papers · 2026-09-21

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [371▲] LimiX-2:面向通用结构化数据智能的上下文机制网络 — https://arxiv.org/abs/2609.17488
  • [135▲] DeepSeek-V4.1-Flash:突破 KV Cache 压缩的极限 — https://arxiv.org/abs/2609.19969
  • [114▲] MiniMax-H3 能理解物理世界吗?一种全模态生成模型的评测 — https://arxiv.org/abs/2609.18323
  • [94▲] 当 EOS token 出现分歧:理解在线策略蒸馏中的长度膨胀现象 — https://arxiv.org/abs/2609.20511
  • [94▲] SoL-Pi:递归扩展自动研究循环以实现高效的 Agent 工具链 — https://arxiv.org/abs/2609.20519
  • [79▲] ScienceIDE:将全球科学代码库转化为 Agent 可学习的环境 — https://arxiv.org/abs/2609.19134
  • [71▲] 面向编码 Agent 的工具链设计实证研究 — https://arxiv.org/abs/2609.20804
  • [65▲] 重新思考 PPO 中的 Critic 学习:理解与缓解价值扁平化 — https://arxiv.org/abs/2609.18708
  • [56▲] JEPA-Anything:跨域世界的预测模型学习 — https://arxiv.org/abs/2609.20800
  • [56▲] 信心源自经验:从推理到 Agent 的经验式置信度估计 — https://arxiv.org/abs/2609.17708
  • [50▲] ProgramDistill:从交互式 Web 应用到可验证的参考引导式 SWE 任务 — https://arxiv.org/abs/2609.18805
  • [48▲] 面向 LLM 助手的可验证社会推理 — https://arxiv.org/abs/2609.17496
  • [45▲] 自演化搜索索引 — https://arxiv.org/abs/2609.19656
  • [45▲] Agora:以 Git 作为集体自动研究的共享记忆 — https://arxiv.org/abs/2609.18094
  • [42▲] RiskChainBench:面向混淆平台消息恢复与证据驱动网络调查的基准 — https://arxiv.org/abs/2609.16900