Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 少复制,多落地:基于证据感知强化学习克服长上下文推理中的重复复制问题 — 生成逐步推理轨迹的大语言模型在复杂任务上已取得强劲性能,将其扩展到长上下文场景已成为一个……
- 用于语言模型推理的选择性状态空间适配与检索 — 低秩适配引入一个静态学习更新,对每个输入完全一致地应用。该更新提供任务级适配,但不显式表示 token 级……
- 评估开放式生成的两级元评分标准:GAMUT,一个面向事实完整性的基准 — 长文本生成的事实性评估主要聚焦于精确率,即衡量模型所生成的声明是否正确。主流的分解-搜索-验证……
- 大规模提示设计:格式、指令数量与上下文长度如何影响大语言模型的指令遵循与幻觉 — 实践者在三个提示设计决策上几乎缺乏受控证据支撑:如何格式化指令与上下文(Markdown、纯文本、散文或表格)……
- 面向 LLM 跨语言事实一致性的推理时引导 — 尽管大语言模型(LLMs)展现出卓越的多语言流畅度,其内部知识表征仍不成比例地偏向高资源语言……