Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- AskChem:以声明为中心的化学文献综合框架 — 化学文献综合往往需要将散落在多篇文献中的特定发现汇总,而现有文献检索系统主要返回的是排序后的文档……
- 诱导语言模型断言自身的意识可恢复人类的信念与价值观 — 对齐大型语言模型以防止其将意识归于自身,却意外地同时改变了其对其他实体"有心智"的表征以及人类的信念……
- 多采样、少反思:在相同 token 成本下,Self-Refine 与 Reflexion 不敌重复采样(模型规模 1.5B 至 7B) — 让语言模型进行规划、批评与重写自身答案、反思错误、从多次尝试中挑选最佳结果或与自身副本辩论的方法,几乎全部……
- Frontis-MA1:面向机器学习工程递归自我改进的 AI4AI 模型训练 — 递归自我改进(RSI)需要能改进 AI 构建过程(即 AI4AI)的 AI 系统;机器学习工程(MLE)提供了一个具体且可执行的测试床……
- ORCA-bench:语言模型 Agent 应对 Oncall 的准备程度如何? — 大语言模型能够编写、补全和检索代码,但 Oncall 根因分析(RCA)需要不同的能力:在噪声指标、日志、追踪和源代码之上进行推理……