HF Daily Papers · 2026-09-18
HF Daily Papers 精选(15 篇,按社区票数排序)
- [295▲] 持续学习机制组合用于长时记忆 — https://arxiv.org/abs/2609.06986
- [113▲] 基础模型时代的游戏 AI — https://arxiv.org/abs/2609.16679
- [105▲] LimiX-2:迈向通用结构化数据智能的上下文机制网络 — https://arxiv.org/abs/2609.17488
- [102▲] StepAudio 3 实时技术报告 — https://arxiv.org/abs/2609.14005
- [88▲] 人类构建的最后一个 AI:迈向真正的递归自我改进 — https://arxiv.org/abs/2609.11873
- [76▲] StepAudio 3 音乐技术报告 — https://arxiv.org/abs/2609.16034
- [70▲] ScienceIDE:将全球科学代码库转化为 Agent 可学习环境 — https://arxiv.org/abs/2609.19134
- [60▲] 重新思考 PPO 中的 Critic 学习:理解与缓解值平坦化 — https://arxiv.org/abs/2609.18708
- [59▲] 广义 Agent 迭代:迭代策略改进与递归自我改进的统一形式化框架 — https://arxiv.org/abs/2609.13406
- [48▲] 信心源自经验:从推理到 Agent 的经验性置信度估计 — https://arxiv.org/abs/2609.17708
- [44▲] ProgramDistill:从交互式 Web 应用到可验证的参考引导 SWE 任务 — https://arxiv.org/abs/2609.18805
- [39▲] Agora:作为集体 AutoResearch 共享记忆的 Git — https://arxiv.org/abs/2609.18094
- [36▲] ActionPiece:重新思考自回归视觉-语言-动作模型的动作 token 化 — https://arxiv.org/abs/2609.18487
- [35▲] VC-Attention:用于低比特注意力机制的值平滑与 Softmax 转换 — https://arxiv.org/abs/2609.15810
- [30▲] EvolveTrade:面向自演进 LLM 交易 Agent 的经验驱动策略优化 — https://arxiv.org/abs/2609.17632