Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 战略性多样化采样用于自训练 — 许多 LLM 训练和推理方法(包括 RL 和测试时 scaling)依赖于重复采样,但仅当响应存在有意义的差异时才能从中受益。自训练 fa…
- MexHat:墨西哥西班牙语视频中的仇恨言论检测数据集 — 通过内容监控确保在线安全,使仇恨言论检测成为一项必须应对的关键任务。本质上,该任务需要捕捉上下文线索,w…
- Muslim:已部署的阿拉伯语语音 AI 平台,提供基于可靠来源的伊斯兰知识 — 我们提出 Muslim,一个生产级阿拉伯语语音 AI 平台,为真实用户提供有依据、可溯源的伊斯兰知识。除了实时语音流水线(NeMo 阿拉伯语 ASR、一个 OpenAI-c…
- 评估 LLM 对海地克里奥尔语的文化意识 — 大语言模型(LLMs)在高资源语言与低资源语言之间表现出显著的性能差距。除了任务性能较低外,它们往往无法捕捉 cu…
- ViSTA:一个简单桥梁,将视觉对齐扩展到多模态 LLM 中的临床时间序列理解 — 临床预测模型根据患者测量数据估计风险,而大语言模型支持医学文本理解和问答。然而,它们的语言 capab…