Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- Vision-Default, Prior-Override:视觉-语言模型中感知-知识冲突的因果机制 — 当视觉证据与记忆中的世界知识相冲突时,视觉-语言模型必须进行调和。其解决冲突的方式决定了多模态系统的可靠性……
- LLM 推理轨迹中的认知片段可实现可解释的人类题目难度预测 — 预测人类题目难度是教育评估的核心,可靠的估计有助于公平性和有效的测试构建。现有方法通常依赖于……
- 从 token 到状态:LLM 作为世界模型的特例及超越的连续路径 — AI 社区将大语言模型 (LLM) 与世界模型的关系框架化为二元对立:LLM 预测 token;世界模型模拟现实。Yann LeCun a……
- 面向 LLM 训练不稳定性前瞻性检测的机制驱动监控器 — 前沿大语言模型训练消耗大量加速器集群和长时钟计算,一旦发生稳定性故障代价高昂。在数值或……
- MultiHashFormer:基于哈希的生成式语言模型 — 语言模型 (LM) 使用随词汇表大小线性扩展的嵌入矩阵来表示 token。为约束参数规模,先前工作提出哈希……