HF Daily Papers · 2026-09-18

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [295▲] 持续学习机制组合用于长时记忆 — https://arxiv.org/abs/2609.06986
  • [113▲] 基础模型时代的游戏 AI — https://arxiv.org/abs/2609.16679
  • [105▲] LimiX-2:迈向通用结构化数据智能的上下文机制网络 — https://arxiv.org/abs/2609.17488
  • [102▲] StepAudio 3 实时技术报告 — https://arxiv.org/abs/2609.14005
  • [88▲] 人类构建的最后一个 AI:迈向真正的递归自我改进 — https://arxiv.org/abs/2609.11873
  • [76▲] StepAudio 3 音乐技术报告 — https://arxiv.org/abs/2609.16034
  • [70▲] ScienceIDE:将全球科学代码库转化为 Agent 可学习环境 — https://arxiv.org/abs/2609.19134
  • [60▲] 重新思考 PPO 中的 Critic 学习:理解与缓解值平坦化 — https://arxiv.org/abs/2609.18708
  • [59▲] 广义 Agent 迭代:迭代策略改进与递归自我改进的统一形式化框架 — https://arxiv.org/abs/2609.13406
  • [48▲] 信心源自经验:从推理到 Agent 的经验性置信度估计 — https://arxiv.org/abs/2609.17708
  • [44▲] ProgramDistill:从交互式 Web 应用到可验证的参考引导 SWE 任务 — https://arxiv.org/abs/2609.18805
  • [39▲] Agora:作为集体 AutoResearch 共享记忆的 Git — https://arxiv.org/abs/2609.18094
  • [36▲] ActionPiece:重新思考自回归视觉-语言-动作模型的动作 token 化 — https://arxiv.org/abs/2609.18487
  • [35▲] VC-Attention:用于低比特注意力机制的值平滑与 Softmax 转换 — https://arxiv.org/abs/2609.15810
  • [30▲] EvolveTrade:面向自演进 LLM 交易 Agent 的经验驱动策略优化 — https://arxiv.org/abs/2609.17632