Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- ConVAWG:一个用于针对妇女和女童暴力领域受控合成对话生成的检索增强框架 — 合成对话生成为研究敏感领域中的对话动态提供了一种途径,因为这些领域的真实数据难以获取、发布或标注。潜在的虐…
- 从可解释性到控制:TrustNLP Workshop 六年的洞察 — 可信赖自然语言处理 Workshop(TrustNLP)自 2021 年起与主要 ACL 会议同期举办,在六届会议中,论文集论文从 8 篇增长到 41 篇,…
- 低资源语言中跨语言安全性的幻觉 — LLM 的安全对齐主要基于英语开发,并假设这些保护措施可以泛化到多语言场景。然而,这一假设仍…
- 注意力路径脆弱性作为 LLM 中的不确定性信号 — 本文提出,模型对 token 的不确定性不仅反映在其输出分布的广度上,还反映在一个自信的预测是否脆弱——在…
- 行动胜于言语:测量工具使用 Agent 中的跨语言策略保留 — 当工具使用 Agent 被赋予相同任务但使用不同语言时,它仍会采取相同的步骤吗?多语言评估很少提出这个问题:它比较最终答案并忽…