Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- Embedding Models Measure in Peculiar Ways — 嵌入空间定义了语义相似度与距离的概念。研究这些嵌入是否反映质量、距离、时间和体积等物理测量……(原文截断)
- Unifying Models of Intergroup Hostility in Online Discourse — 针对社会群体的敌对言论可能使排他行为正常化并为不公正对待提供借口,同时加剧日益严重的极化和政治暴力。旨在……
- JEPA-Anything: Learning Predictive Models across Different Worlds — 世界建模使智能体能够预测后果、引导干预并从交互中学习。然而预测模型仍局限于特定领域:能否建立一种通用……
- RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning — 基于强化学习(RL)训练的多轮 Agent 每个轨迹仅获得一个标量奖励,这促使自 on-policy 蒸馏(OPD)以提供密集的 token 级……
- Harm Laundering in GPT Models: Evidence That Gender Discrimination Is Transformed Rather Than Reduced Across Safety-Trained Generations — 针对大语言模型的安全评估依赖基于表面形式的分类器,这类分类器报告的伤害分数在跨代际间持续下降。本文提供证据表明该方法存在……