Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 通过训练编译:将自然语言规范转化为本地神经函数 — 许多重复出现的文本函数易于描述但难以用规则实现,而对每个输入都调用大型远程模型会带来重复的成本、延迟以及……
- ESPO:通过诊断、多样化与稳定化实现的错误结构化提示优化 — GEPA 等进化型提示优化器存在提示膨胀问题:每次迭代都会追加规则和注意事项,使提示长度最多增至 3 倍,但准确性并未提升。我们……
- 可读性不等同于可解释性:比较思维链推理中判断重要性与实际重要性 — 思维链模型的推理过程看似为模型如何得出答案提供了一个可读的窗口。越来越多的研究将其视为如此,使用 LLM 评判……
- 预训练阶段的知识获取?大语言模型借助辅助视图学习效果更佳 — 我们对大语言模型(LLMs)在预训练期间如何获取知识的理解仍存在空白。我们假设知识的辅助视图(即知识的重新表述)对……
- 终极翻译基准 — 为推动科学进步,我们需要能够测试 SOTA 模型极限的基准,以及能揭示失败案例的评估方法。随着模型变得更强,标准……