Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- Transformer 中的距离泛化:为什么还要操心位置编码? — 分布外长度泛化,即将任务从短上下文外推到长上下文,已在 Transformer 中得到广泛研究。本文聚焦于距离泛化……
- Nuha-Speech:构建通用型阿拉伯语语音 LLM — 随着语音大语言模型(speech-LLMs)日益多语言化,阿拉伯语仍严重欠缺代表,凸显了对专用基础设施的需求……
- 大语言模型中的领域特定幻觉检测 — 大语言模型生成的流畅文本可能包含不忠实陈述,这一现象被称为幻觉。本文提出一种结合微调……的多信号检测流水线。
- Augustinian BabyLM:指示定义能教会小语言模型什么、不能教会什么 — 语言模型通常以随机词嵌入开始训练:无论"banana"是什么意思,都必须从训练语料中学习。作者实现了圣奥古斯丁的词义……
- 认识论取向预测美国国会议员的立法效能 — 真相与基于证据的沟通为民主治理、问责制与集体决策提供了重要基础。先前研究表明,基于证据的……