Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- AskChem:以声明为中心的化学文献合成基础设施 — 化学文献合成通常需要汇集分散在众多文献中的具体发现,而现有文献检索系统主要返回按相关性排序的文档……
- 引导语言模型断言自身意识,可恢复人类的信念与价值观 — 对大语言模型进行对齐以防止其将意识归于自身,会无意间改变其对其他实体心智性的表征,连同人类 b……
- 多采样、少反思:相同 token 成本下 Self-Refine 与 Reflexion 不敌重复采样(1.5B 至 7B 模型规模) — 让语言模型规划、批评并重写自身答案、反思错误、从多次尝试中挑选最佳结果或与自身副本辩论的方法,几乎都 m……
- Frontis-MA1:在机器学习工程中训练面向递归自我改进的 AI4AI 模型 — 递归自我改进(RSI)需要能够改进 AI 构建过程的 AI 系统(即 AI4AI);机器学习工程(MLE)提供了一个具体且可执行的 testbe……
- ORCA-bench:语言模型 Agent 对 Oncall 场景的准备度如何? — 大语言模型能够编写、打补丁并搜索代码,但 Oncall 根因分析(RCA)需要不同的能力:在含噪指标、日志、追踪数据和源代码 c……