HF Daily Papers · 2026-09-19
HF Daily Papers 精选(15 篇,按社区票数排序)
- [166▲] LimiX-2: 一种面向通用结构化数据智能的上下文机制网络 — https://arxiv.org/abs/2609.17488
- [73▲] ScienceIDE: 将全球科学代码库转化为 Agent 可学习的环境 — https://arxiv.org/abs/2609.19134
- [62▲] 重新审视 PPO 中的 Critic 学习:理解与缓解 Value Flattening — https://arxiv.org/abs/2609.18708
- [57▲] DeepSeek-V4.1-Flash: 突破 KV Cache 压缩的极限 — https://arxiv.org/abs/2609.19969
- [54▲] Confidence 源于经验:从推理到 Agent 的经验置信度估计 — https://arxiv.org/abs/2609.17708
- [47▲] SoL-Pi: 递归扩展 Auto-Research 循环以实现高效的 Agent Harness — https://arxiv.org/abs/2609.20519
- [46▲] ProgramDistill: 从交互式 Web 应用到可验证的参考引导 SWE 任务 — https://arxiv.org/abs/2609.18805
- [41▲] Agora: 以 Git 作为集体 AutoResearch 的共享记忆 — https://arxiv.org/abs/2609.18094
- [39▲] ActionPiece: 重新思考自回归视觉-语言-动作模型中的 Action Tokenization — https://arxiv.org/abs/2609.18487
- [37▲] Coding Agent 的 Harness 设计实证研究 — https://arxiv.org/abs/2609.20804
- [35▲] VC-Attention: 用于低 bit Attention 的 Value Smoothing 与 Softmax Casting — https://arxiv.org/abs/2609.15810
- [31▲] 当 EOS Tokens 出现分歧:理解 On-Policy Distillation 中的长度膨胀现象 — https://arxiv.org/abs/2609.20511
- [31▲] EvolveTrade: 面向自演化 LLM 交易 Agent 的经验驱动策略优化 — https://arxiv.org/abs/2609.17632
- [29▲] Zing-0.5: 迈向具备实时联合动作与文本控制的可游玩世界 — https://arxiv.org/abs/2609.17909
- [25▲] HypoEvolve: 利用遗传算法使 Multi-Agent LLMs 能够发现科学假设 — https://arxiv.org/abs/2609.15938