HF Daily Papers · 2026-09-19

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [166▲] LimiX-2: 一种面向通用结构化数据智能的上下文机制网络 — https://arxiv.org/abs/2609.17488
  • [73▲] ScienceIDE: 将全球科学代码库转化为 Agent 可学习的环境 — https://arxiv.org/abs/2609.19134
  • [62▲] 重新审视 PPO 中的 Critic 学习:理解与缓解 Value Flattening — https://arxiv.org/abs/2609.18708
  • [57▲] DeepSeek-V4.1-Flash: 突破 KV Cache 压缩的极限 — https://arxiv.org/abs/2609.19969
  • [54▲] Confidence 源于经验:从推理到 Agent 的经验置信度估计 — https://arxiv.org/abs/2609.17708
  • [47▲] SoL-Pi: 递归扩展 Auto-Research 循环以实现高效的 Agent Harness — https://arxiv.org/abs/2609.20519
  • [46▲] ProgramDistill: 从交互式 Web 应用到可验证的参考引导 SWE 任务 — https://arxiv.org/abs/2609.18805
  • [41▲] Agora: 以 Git 作为集体 AutoResearch 的共享记忆 — https://arxiv.org/abs/2609.18094
  • [39▲] ActionPiece: 重新思考自回归视觉-语言-动作模型中的 Action Tokenization — https://arxiv.org/abs/2609.18487
  • [37▲] Coding Agent 的 Harness 设计实证研究 — https://arxiv.org/abs/2609.20804
  • [35▲] VC-Attention: 用于低 bit Attention 的 Value Smoothing 与 Softmax Casting — https://arxiv.org/abs/2609.15810
  • [31▲] 当 EOS Tokens 出现分歧:理解 On-Policy Distillation 中的长度膨胀现象 — https://arxiv.org/abs/2609.20511
  • [31▲] EvolveTrade: 面向自演化 LLM 交易 Agent 的经验驱动策略优化 — https://arxiv.org/abs/2609.17632
  • [29▲] Zing-0.5: 迈向具备实时联合动作与文本控制的可游玩世界 — https://arxiv.org/abs/2609.17909
  • [25▲] HypoEvolve: 利用遗传算法使 Multi-Agent LLMs 能够发现科学假设 — https://arxiv.org/abs/2609.15938