Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 嵌入模型以奇特的方式进行度量 — 嵌入空间定义了语义相似度和距离的概念。我们研究这些嵌入是否反映质量、距离、时间和体积的物理度量…
- 在线话语中群体间敌意的统一建模 — 针对社会群体的敌对言论可以将排斥行为正常化,为不当对待正名,同时加剧日益严重的极化和政治暴力。旨在缓和此类…
- JEPA-Anything:跨不同世界学习预测模型 — 世界建模使智能体能够预见后果、引导干预并从交互中学习。然而预测模型仍局限于特定领域:是否存在一种通用学习…
- RetireOPD:面向智能体强化学习的自退出式在策略蒸馏 — 使用强化学习(RL)训练的多轮智能体每条轨迹仅获得一个标量奖励,这促使自在线策略蒸馏(OPD)提供密集的 token 级…
- GPT 模型中的伤害洗白:证据表明性别歧视在安全训练迭代中被转化而非减少 — 大语言模型的安全评估依赖表层形式的分类器,这类分类器报告各代模型中持续下降的伤害分数。我们提供证据表明该方法…