Cool Papers · cs.IR (papers.cool) · RSS 摘要
信源:Cool Papers · cs.IR (papers.cool) · https://papers.cool/arxiv/cs.IR/feed
- 将 BrowseComp-Plus 投影到 ClimbMix:迈向更真实的 Agentic Search 语料库 — BrowseComp-Plus 基准通过用固定语料库替代不透明的网络搜索,解耦了 Agentic search 的评估,从而可将 Agent 的角色与检索器的作用分离开来……
- 怎样的 Fiqh 检索器才算优秀?面向阿拉伯伊斯兰法学的答案检索 — 检索增强生成(RAG)被用于伊斯兰问答任务,但多数系统采用端到端评估,导致检索失败难以与生成失败区分开来……
- Daedalus-150M:面向 CPU 推理设计的卷积-注意力混合架构 — 小语言模型通常按大模型的范式构建,再压缩到 CPU 上运行。我们反其道而行:先锁定目标——单用户、单 token、4-bit 精度……
- SCoRD:面向基于 LLM 推荐的语义辅助持续 Retriever-Reranker 蒸馏 — 推荐系统日益采用两阶段 pipeline:基于 ID 的检索器召回候选,基于 LLM 的重排序器精细化排序。为提升二者协同效果……
- 序列推荐基准真的需要高阶序列建模吗? — 序列推荐器越来越多地采用语言模型架构以捕捉复杂的、上下文相关的交互。然而,广泛使用的基准是否真正需要此类高阶建模能力尚不明确……