Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 用价值表征预测对齐泛化 — LLM 开发者对模型进行后训练,使其表现对齐目标中所列的亲社会价值观与行为特征。然而,尽管近期后训练在...
- Latent Core Tokenizer:有意义地压缩 — Tokenizer 通常以压缩为优化目标,但紧凑的词表未必能将其容量均匀分配到各语言。我们提出 Latent Core Toke...
- 该蒸馏哪个 Skill?SGUID:为模型-Skill 协同进化选择紧凑的 Skill 库 — Skill 即在推理时注入的可复用过程性指导,可显著提升 LLM 的下游表现(Li et al., 2026)。已有工作通过语义方式从 Skill 库中检索 Skill...
- VFold:感知对称性的跨层 Value Cache 压缩 — 缓存 KV 状态能加速 LLM 解码,但在长上下文下该缓存会主导显存占用。一种方案是对其进行压缩...
- HarnessSQL:面向真实数据库环境的 Harness 原生 SQL Agent 训练 — Text-to-SQL 模型通常被训练为直接将问题映射为静态查询,而现实场景中的数据库 Agent 则通过与在线数据库的有状态、多轮交互来运作...