Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- Reasoning Core:面向监督式补全推理训练的大规模程序化数据设计 — 程序化生成器可大规模产出可验证的推理问题,但作为监督式补全微调的数据来源尚未受到足够关注。我们提出 Reasoning…
- 迈向技能原生 LLM:用于长程推理基准测试与训练的技能熵 — 近期 LLM 的长程推理要求模型在推理链中切换不同技能,例如先进行数学推导,再利用该结果…
- 口语函数调用:大音频语言模型口语语言理解的新视角 — 口语语言理解(SLU)是任务型对话系统的核心组件,也是实现无缝人机交互的关键环节。传统 SLU…
- 链式递归语言模型用于多轮迭代推理 — 大语言模型(LLM)的长上下文推理通常受限于单一推理轨迹必须同时探索上下文、存储中间…
- 相同形式,不同语义:语言模型是否遵循模态逻辑规范? — 关于必然性与可能性的推理依赖于世界间可达性的假设以及每个世界中存在哪些对象的假设。因此同一推理在不同情境下可能成立也可能不成立…