Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- Compile by Training:将自然语言规约转化为本地神经函数 — 许多反复出现的文本函数易于描述却难以用规则实现,而对每个输入调用大型远程模型会带来重复的成本、延迟和……
- ESPO:通过诊断、多样化与稳定化实现的错误结构化提示优化 — 进化式提示优化器(如 GEPA)存在提示膨胀问题:每次迭代都会追加规则与例外,导致提示长度增至 3 倍却并未带来更高准确率。我们提出……
- 可读性不等于可解释性:思维链推理中判断重要性与实际重要性的对比 — 思维链模型的推理轨迹看似提供了一个可读的窗口,揭示模型如何得出答案。越来越多的研究据此使用 LLM 评判器……
- 预训练期间的知识获取?大语言模型借助辅助视图学习效果更佳 — 我们对大语言模型在预训练期间如何获取知识仍存在理解缺口。我们假设辅助视图(即知识的重新表述)对……
- Last Translation Benchmark — 要推动科学进步,我们需要能够测试 SOTA 模型极限的基准,以及能揭示失败案例的评估方法。随着模型变得更强……