Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- [文本 → 文本] 内省耦合:自解释训练追踪行为变化,即使监督信号固定 — [文本 → 文本] 何时训练语言模型(LMs)让其生成预测解释会产出忠实的内省,而非浅层模仿?我们研究了被训练去……
- [文本 → 文本] 带有元认知反馈的强化学习可激发 LLM 中忠实的置信度表达 — [文本 → 文本] 元认知是智力的关键组成部分,描述了监控和调节自身认知过程的能力。然而 LLM 在关键方面存在系统性缺陷……
- [文本 → 文本] 当 LLM 粗心读取表格:衡量并减少数据引用错误 — [文本 → 文本] 尽管 LLM 在表格任务上表现出色,但它们仍会产生数据引用错误(DREs),即在理解表格内容的情况下错误引用或遗漏表格中的值……
- [文本 → 文本] LLM Agent 的生成式 Skill 组合 — [文本 → 文本] 近期 LLM Agent 借助 Skill 解决复杂任务。Skill 将模块化的程序性知识与执行特定任务的指令封装在一起,例如……
- [文本 → 文本] 基于 Skill 蒸馏的浏览器可扩展行为克隆 — [文本 → 文本] 互联网用户通过 Web 浏览器集体执行着大量技能型工作,涵盖软件开发、文档编辑、搜索、表单填写以及企业工作流……