Cool Papers · cs.IR (papers.cool) · RSS 摘要
信源:Cool Papers · cs.IR (papers.cool) · https://papers.cool/arxiv/cs.IR/feed
- 评分量规校准的偏好:基于项目反应理论的 LLM 判断跨查询校准 — 重排序器决定用户和 LLM 看到的文档,但其标准指标 nDCG 依赖人工相关性标注——成本高、稀疏、有噪声且为离散分级。随...
- 生成式检索器能否学习语义 ID 而不忘丢失"说话"能力? — 生成式检索(GR)通过生成文档语义标识符(SID)实现端到端检索。然而,仅面向检索的微调可能导致预训练语言模型...
- 信号还是噪声?多模态 GraphRAG 中的模态贡献与协同 — 多模态知识图谱(KG)将文本、图表、表格及其他模态信息整合为统一结构化表示,承诺借助更丰富的证据...
- RenderRank:基于压缩视觉 token 的文本重排序学习 — 将文档文本渲染为图像,使视觉-语言模型能将文档编码为视觉 token,相较于文本输入可缩短输入序列长度。这一压缩...
- 基于全局列表式学习与渐进式双向加权的推荐流行度偏差缓解 — 推荐系统中用户反馈通常呈长尾分布,导致许多推荐算法因不成比例地偏向热门物品而加剧流行度偏差...