Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 用于放射学报告结构化与质量保证的多 Agent AI 系统(由放射科医生独立评估) — 目的:开发并评估一个本地部署的、用于放射学报告结构化与质量保证的多 Agent AI 系统。材料与方法:本回顾性研究……
- TokEval:一个分词器评估套件 — 语言模型的分词器通常在缺乏充分评估的情况下被选用,尽管其设计选择直接影响模型能力。这部分归因于……
- 语言具有两个参数:叙事诱导的语义可塑性与相位敏感的解读 — 语言具有两个参数。统计词语共现的频率即可估算其振幅——即关联强度。词嵌入与注意力权重在此基础上对该统计进行细化……
- 用于 LLM 持续改进的经验链(Chain-of-Experience) — 人类能够从经验中持续学习,而传统的 LLM 评估忽略了模型通过推理时交互实现改进的能力。在……
- IOL-AI 挑战赛:面向推进语言推理能力提升的开放挑战赛 — LLM 的推理研究主要集中于存在明确规则的领域,如数学与代码。语言类谜题则恰恰相反:解题者必须首先发现其系统……