Cool Papers · cs.IR (papers.cool) · RSS 摘要
信源:Cool Papers · cs.IR (papers.cool) · https://papers.cool/arxiv/cs.IR/feed
- 仅分数蒸馏用于紧凑型密集检索 — 大型 embedding 模型能提升检索质量,但在线部署大编码器成本高昂。本文研究紧凑型检索器能否仅从打分中学习教师模型的排序行为……
- FAIR GraphRAG:一种用于语义数据分析的检索增强生成方法 — 检索增强生成(RAG)缓解了 LLM 在回答领域特定问题时的局限。基于图的 RAG 方法……
- 超越语义 ID:将业务价值排序编码到生成式检索的文档标识符中 — 生成式检索(GR)将检索建模为序列到序列的生成任务,为每个文档分配文档标识符(DocID),通过自回归方式……
- 布尔查询就够了? — 我们为基于 LLM 的搜索 Agent 配备了布尔检索引擎,用于在 TREC 2024 RAG track 所使用的 MS MARCO V2.1 去重段落集合上进行检索。在标准……
- 利用 LLM 归纳用户偏好以进行离线 Top-N 推荐评估 — 离线评估是比较 Top-N 推荐系统的标准方法,但依赖于不完整的相关性信息。在大多数基准数据集中,仅有少量……