Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- EngramEdit:通过条件记忆实现 LLM 中的解耦式知识更新 — DeepSeek Engram 等条件记忆架构使用输入 n-gram 查找学习得到的嵌入,从而在有限额外……的条件下扩展大型语言模型(LLM)的容量
- 你的提示词应发挥更大作用:检索指令对嵌入模型的影响 — 基于提示的嵌入模型近来受到越来越多的关注,尤其是在检索场景中,详细的检索指令会作为检索提示词的一部分提供……
- PHRBench:对 LLM 幻觉后推理的行为评估 — 幻觉信息可能在多阶段 LLM 系统中传播,并成为后续推理的上下文。现有幻觉后推理(P…)研究……
- CoTrace:通过运行时框架—模型协同演化训练终端 Agent 的数据配方 — 终端 Agent 的能力由模型权重与运行时框架共同决定;该框架负责格式化提示词、绑定工具并处理错误恢复。现有运行时框架—模型协同演化……
- 利用大型语言模型进行爱沙尼亚语的文档级文本简化 — 文档级文本简化涉及超越句内编辑的转换,需要兼顾语篇连贯性、回指消解和跨段落一致性……