Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- AskChem:以论点为中心的化学文献综合基础设施 — 化学文献综合往往需要整合散落在多篇文献中的具体发现,而现有文献检索系统主要返回排序后的文档……
- 引导语言模型主张自身意识可恢复人类的信念与价值观 — 对齐大语言模型以防止其将意识归因于自身,会无意间改变其对其他实体心理状态的表征以及人类……
- 多采样少反思:同等 token 成本下 Self-Refine 与 Reflexion 不敌重复采样,覆盖 1.5B 至 7B 模型 — 让语言模型规划、批评与改写自身答案、反思错误、从多次尝试中择优或与自身副本辩论的方法几乎都……
- Frontis-MA1:面向机器学习工程递归自我改进的 AI4AI 模型训练 — 递归自我改进 (RSI) 要求 AI 系统能够改进构建 AI 的流程(即 AI4AI);机器学习工程 (MLE) 提供了一个具体、可执行的测试……
- ORCA-bench:语言模型 Agent 应对 Oncall 的准备程度如何 — 大语言模型能够编写、补丁与检索代码,但 oncall 根因分析 (RCA) 需要不同的能力:对含噪的指标、日志、链路追踪与源代码……