Cool Papers · cs.IR (papers.cool) · RSS 摘要
信源:Cool Papers · cs.IR (papers.cool) · https://papers.cool/arxiv/cs.IR/feed
- 优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中悄然消耗加速器容量。我们最大的推荐工作负载处理数百亿训练...
- AgentWebRec:基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正逐渐成为用户语义的持久载体以及用户与推荐平台之间的中介,维护着更丰富的用户知识...
- 从规则到神经图:面向专利现有技术检索的可扩展结构化预测 — 专利检索需要处理的文档经常超过数万个 token。大多数神经检索方法在截断输入上运行,限制了其有效...
- 从用户生成的主题语料中学习数据结构化 — 主题语料库(如社交媒体社区)包含描述可被结构化数据的非结构化文本。这些包括例如个人属性、行为...
- 多语言编码器能否生成语言一致性的 Semantic ID? — Semantic IDs (SIDs) 将 item 嵌入压缩为生成式检索中使用的离散码序列。我们探讨多语言编码器是否足以处理不同语言...