Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- ToolSciVer:基于视觉工具增强强化学习的多模态科学声明验证 — 多模态科学声明验证(MSCV)要求模型利用论文中视觉锚定的证据来验证科学声明,包括图、表格、图表及文本……
- 语言编码的率-效用前沿:在受控语言内容下对比 token、字节与像素 — 语言模型将文本编码为子词 token、原始字节或渲染像素,但这些编码通常在建模约束下进行比较,不同约束会暴露不同信息量……
- 控制 L2 英语口语自动评分器中的隐式捷径依赖 — 越来越多的语音与语言处理任务直接以音频或文本作为输入,而非从中提取特征再送入分类器或回归器……
- 前沿 LLM 难以完成复制任务:文本更适合以二维方式呈现 — 尽管 LLM 能在数秒内解决高阶推理问题,我们发现即使是前沿模型也无法完成一项更简单的操作:精确复制一段……
- 前沿 AI 在商业学科中的表现:基于案例的知识工作与分析推理基准 — LLM 正快速进步,基准分数也反映了这一点,但这些 AI 基准主要测试事实回忆、窄域问答等能力……