Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 多轮长程规划物理:从预训练到后训练的单教师与多教师在策略智能体蒸馏 — 多轮长程规划对基础模型智能体至关重要,但如何从根本上提升其能力仍不清晰。现有模型在不可控且开……
- DataOrchestra:学习编排预训练数据的逐样本策展 — 预训练数据处理对大型语言模型(LLM)的下游性能至关重要。然而,许多现有方法在整个……
- Kimi K3:开放前沿智能 — 我们推出 Kimi K3,一个拥有 2.8T 参数、104B 激活参数的 Mixture-of-Experts 模型,具备原生视觉能力和 1M token 上下文窗口。Kimi K……
- 循环不等于可靠:面向智能体代码修复的状态约束证据与类型化修订契约 — 生成—测试—修订循环在编程智能体中很常见,但仅靠重复并不能保证可靠性。我们研究了在生成……
- PIVOT:面向 token 级稀疏注意力的高效查询分组索引 — token 级稀疏注意力(如生产系统中的 DeepSeek Sparse Attention (DSA))使下游注意力计算更高效,但将瓶颈转移至索……