Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- ConceptGuard:面向大语言模型上下文敏感遗忘的基准评测 — 大语言模型(LLM)越来越需要选择性地移除有害或敏感知识,即遗忘机制,但现有方法和基准未能有效评估这一点……
- G-CARL:面向以患者为中心的医学报告解读的、基于检查清单对齐的奖励学习 — 针对医学报告的个性化解读已成为患者日益迫切的需求。满足该需求既需要基于证据的医学事实性……
- 从计算机使用轨迹中归纳任务模型 — 真实场景下的计算机使用轨迹——被动记录的截图与鼠标或键盘操作——是推导可符号化、可审计、可复用的人机交互模型的宝贵资源……
- 注入、对齐、恢复:面向无检索文档知识内化的分阶段后训练 — 大语言模型在推理阶段未检索源文档时,常无法回答关于有界文档集合的问题。我们将该场景研究为文档知识内化……
- Task-CoEvolve:通过自适应验证任务选择实现 Harness 高效优化 — 我们提出一种通过自适应验证任务选择实现 LLM Agent Harness 高效优化的新方法。Harness 优化通过反复改写 Harness 代码库……