Cool Papers · cs.IR (papers.cool) · RSS 摘要
信源:Cool Papers · cs.IR (papers.cool) · https://papers.cool/arxiv/cs.IR/feed
- 优化大规模推荐系统的有效训练时间 — 生命周期开销在大型推荐训练集群中悄无声息地消耗加速器容量。我们的最大型推荐工作负载每轮迭代处理数百亿训练样本……
- AgentWebRec:基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体以及用户与推荐平台之间的中介,维护着比传统用户画像更丰富的用户知识……
- 从规则到神经图:面向专利现有技术检索的可扩展结构化预测 — 专利检索需要处理的文档动辄超过数万个 token。大多数神经检索方法都在截断后的输入上运行,限制了其有效……
- 从用户生成的主题语料中学习数据结构化 — 主题语料(如社交媒体社区)包含描述可结构化数据的非结构化文本。这些数据例如包括个人属性、行为……
- 多语言编码器能否生成语言一致的语义 ID? — 语义 ID(SID)将 item embedding 压缩为离散码序列,用于生成式检索。我们探讨单一多语言编码器是否足以处理不同语言的……