Cool Papers · cs.IR (papers.cool) · RSS 摘要
信源:Cool Papers · cs.IR (papers.cool) · https://papers.cool/arxiv/cs.IR/feed
- 将 BrowseComp-Plus 投影到 ClimbMix:迈向更真实的 Agentic Search 语料库 — BrowseComp-Plus benchmark 通过将不透明的 web search 替换为固定语料库,拆解了 agentic search 的评估,从而能够将 Agent 的角色与检索器分开……
- 什么是好的 Fiqh 检索器?面向阿拉伯伊斯兰法学的答案检索 — RAG 被用于伊斯兰问答任务,但大多数系统采用端到端评估,导致检索失败难以与生成失败区分开……
- Daedalus-150M:为 CPU 推理设计的卷积-注意力混合架构 — 小语言模型通常像大模型那样构建,之后再压缩到 CPU 上。我们反其道而行:先确定目标——一个用户、一次一个 token、4-b……
- SCoRD:面向基于 LLM 推荐系统的语义辅助持续 Retriever-Reranker 蒸馏 — 推荐系统日益采用两阶段 pipeline,其中基于 ID 的 retriever 检索候选样本,基于 LLM 的 reranker 优化其排序。为提升 retri……
- 序列推荐 benchmark 是否真的需要高阶序列建模? — 序列推荐器日益采用为捕捉复杂、上下文相关交互而设计的语言模型架构。然而,广泛使用的 ben……是否真的需要这些能力仍不清楚……