Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 从文本语料库学习人类语言的形式局限性 — 听话者能否仅从话语形式还原说话者的意图?我们从信息论角度回答此问题,并针对由任意特征提取器建模的听话者……
- 基于自监督语音表示的音素级与词级强制对齐评估指标 — 强制对齐评估通常依赖人工标注时间戳,难以规模化且不利于多语言分析。我们提出两个基于自[监督表示的语料库级指标]……
- 混沌之梯:测试时 scaling 在何时、如何(或许为何)能提升 LLM 机器翻译 — LLM 的两种测试时 scaling 范式已成为高效且广泛采用的方式:顺序式——后续尝试依赖先前结果;……
- NL2AGBench:面向 AlphaGeometry 的 LLM 自动形式化基准测试 — LLM 在自然语言理解和数学推理方面表现强劲。然而,其将[自然语言转换为形式化证明语言的能力仍待考察]……
- 盲人摸象:探究 LLM 在长尾分歧知识下的认知短视 — 事实问答(QA)通常预设单一标准答案,掩盖了 LLM 是否保留长尾事实的多种说法[这一问题]……