Cool Papers · cs.IR (papers.cool) · RSS 摘要
信源:Cool Papers · cs.IR (papers.cool) · https://papers.cool/arxiv/cs.IR/feed
- 优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中静默消耗加速器容量。我们最大的推荐工作负载处理数百亿条训练...
- AgentWebRec: 基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体,以及用户与推荐平台之间的中介,维护更丰富的用户知识...
- 从规则到神经图: 可扩展的结构化预测用于专利现有技术检索 — 专利检索需要处理动辄超过数万 token 的文档。大多数神经检索方法在截断后的输入上运行,限制了其有效...
- 从用户生成的主题语料中学习数据结构化 — 主题语料(如社交媒体社区)包含描述可被结构化数据的非结构化文本。这些包括个人属性、行为...
- 多语言编码器能否生成语言一致的语义 ID? — 语义 ID (SID) 将物品 embedding 压缩为离散码序列,用于生成式检索。我们探讨多语言编码器是否足以支持不同语言...