Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 传递接力棒:基于轨迹延迟的 On-Policy 蒸馏 — On-Policy 蒸馏(OPD)将 token 级监督锚定在学生模型自身轨迹上,但仍存在前缀失败问题:一旦学生模型在推理方向上出现早期误判,后续生成便难以挽回。
- UniMem:面向无边界任务流的从情景记忆到参数记忆的互补记忆机制 — 记忆是 LLM Agent 累积任务经验、复用特定任务执行策略的关键。然而,在无边界且持续演化的真实任务流中部署时,现有方法难以同时兼顾对近期上下文的快速调用与对长期知识的稳定保持。
- 指令微调模型在局部对人类句法的复用程度甚至超过人类自身 — 句法趋同(说话者在语言上向对话者的语法特征靠拢的倾向)是人类对话中一个被广泛记录的特征……
- 跨文本、表格与知识图谱的知识不一致性检测 — Wikipedia 和 Wikidata 被广泛用于信息获取、LLM 预训练和检索增强生成(RAG)。其知识深度关联,但分散于文本……
- Polistemics:评估 LLM 作为政治与选举信息中介的表现 — 随着 LLM 日益充当公民所依赖的政治信息中介,目前仍缺乏评估其是否负责任地承担这一角色的标准化方法。我们提出 Polistemics,一项……