Cool Papers · cs.CL (papers.cool) · RSS 摘要
信源:Cool Papers · cs.CL (papers.cool) · https://papers.cool/arxiv/cs.CL/feed
- 扩展视野,而非参数:借助 35B Agent 实现万亿参数级性能 — 我们提出 Agents-A1,一个 35B Mixture-of-Experts Agentic Model,通过扩展 agent horizon 达到万亿参数级性能。我们研究了 agent-horizon 扩展……
- 模糊情境下感知不确定性的生成与决策 — 随着能力快速提升,大语言模型 (LLMs) 越来越多地应用于复杂的现实任务中。这类任务不仅要求具备深入的知识与推理能力,……
- 向混合注意力模型的演化 — 混合注意力模型通过仅保留部分全注意力层、将其余层替换为线性注意力来提升长上下文效率。然而,……
- Poller:LLM 适合用于评估诗歌理解任务吗? — 传统自动评估方法已被证不适于现代中国诗歌,原因在于该文学体裁的独特性。人工评估仍……
- TRACE:双人对话中基于时间关系感知的会话趋同检测 — 随着语音 AI agents 的普及,理解会话交互中的情感趋同变得日益重要。情感趋同受到……