Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- LLM 应该在何时弃答?面向选择性风险控制的自我追问链 — 当事实依据薄弱时,大语言模型仍会生成流畅回答。本文提出 Chain-of-Self-Questioning (CoSQ),一种仅依赖 prompt 的框架,使答案……
- 智能家居中剪枝会破坏什么,何时发生?跨架构与任务复杂度的 LLM 性能退化评估 — 剪枝可降低大语言模型 (LLM) 的部署成本,但其对基于上下文的工具调用的影响仍缺乏理解。本文系统研究剪枝……
- 合适的工具,合适的任务:来自纯法语 BabyLM 的母语评估、tokenizer 敏感性与方法学发现 — 我们将 MéTRON-FR(一个在 92.47M 法语词上预训练的 125M GPT-2)提交至 BabyLM 2026 Strict 赛道。它在 QFrBLiMP(一个母语魁北克法语基准……)上得分为 85.97 +/- 0.17%
- 通过大语言模型驱动的 PLA 提升医学文本的可及性 — 本文研究如何通过自动化的 PLA(Plain Language Adaptation)让复杂医疗信息更易获取。PLA 旨在简化专业技术医学……
- ECHO:面向全双工对话中上下文敏感话轮切换的匹配对比基准 — 全双工口语对话系统必须区分需要让出话轮的中断与允许继续发言的反馈语 (backchannel)。现有基准通常……