Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 走向计算溯源:在生成文本中携带因果状态证据 — 语言模型的输出本身无法提供关于其内部计算过程的可验证证据。我们研究计算溯源:生成文本……
- 模型催眠:通过叠加式潜意识效果对 AI 实现强控制 — 我们证明 AI 模型普遍容易受到一种我们称为"模型催眠"的现象影响——prompt 中单独看来微弱且看似无关的线索可被系统地……
- ClawGym II:探索 Agent Harness 上的黑盒强化学习 — Agent harness 通过协调 Agent 与环境的交互,显著提升了长程任务性能。然而,通过 comp…… 的强化学习……
- 语义老虎机:上下文中的探索-利用受语义先验偏差影响 — LLM 越来越多地被部署为决策 Agent,用于需要复杂环境探索的场景。然而,已有工作提出了……
- LM Head 是否造成了有害的梯度瓶颈?一个因果测试 — 语言模型 head 将宽度为 D 的隐藏状态映射到大小为 V 的词表,因此其转置最多只能向 Transformer 返回 D 个独立方向。Godey 和 Artzi……