Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- ReCite:面向忠实引用的 Agentic 推理 — 准确的引用是学术写作的基石,可追溯思想源头并佐证核心论点。然而,面对持续增长的科学…
- Measuring LLM Sycophancy under Sustained Multi-Turn Pressure — 大语言模型(LLMs)在用户施压时可能放弃正确立场,表现出被称为"谄媚性"的失效模式。现有评测通常采用短轮、预设…
- 制造注意力汇聚的并非 RoPE:自汇聚与 Value-Non-Mixing 在注意力中的作用 — 大语言模型(LLMs)常在序列起始位置出现"注意力汇聚"(AS)及伴随的"巨量激活"(MAs)。这些现象常…
- ActReview:基于 Rebuttal 引导的训练数据与 Rubric 奖励,用于生成可执行的同行评审 — 随着 LLM 越来越多地用于投稿前自审,亟需不仅能识别弱点、还能引导作者进行具体修改的反馈…
- ToolLoop:通过分解生成与动态自反馈实现闭环工具使用数据合成 — 高质量的工具使用数据对训练语言模型与外部工具高效交互至关重要。然而,现有合成方法通常采用先生成…