Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- ConceptGuard:面向大语言模型的上下文敏感遗忘能力基准测试 — 大语言模型(LLM)日益需要对有害或敏感知识进行选择性移除(即遗忘),但现有方法和基准未能有效评估这一能力……
- G-CARL:面向患者导向医学报告解读的、基于证据且对齐清单的奖励学习 — 患者对医学报告的个性化解读需求日益凸显。满足该需求既需要基于证据的医学事实性……
- 从计算机使用轨迹中归纳任务模型 — 自然场景下的计算机使用轨迹(被动记录的截图以及鼠标或键盘操作)是推导可符号化、可审计、可复用的……模型的宝贵资源……
- Inject, Align, Recover:面向无检索文档知识内化的分阶段后训练 — 在推理阶段未检索源文档时,大语言模型常常无法回答关于限定文档集合的问题。我们将这一设定研究为文档知识内化……
- Task-CoEvolve:通过自适应验证任务选择实现高效的 Harness 优化 — 我们提出一种通过自适应验证任务选择来高效优化 LLM Agent Harness 的新方法。Harness 优化通过迭代改写 harness 代码库……