SA-RSQ: A Versatile Sparse Representation Framework for Multi-modal Recommender Systems
该论文提出了 SA-RSQ,这是一个用于多模态推荐系统的通用框架,它利用基于稀疏激活的残差软量化来存储紧凑的(索引,概率)元组,在有效平衡存储效率与重构质量的同时,在工业应用中实现了 CTR 和 CPM 的显著提升。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
在当今庞大的数字市场中,推荐系统扮演着我们生活中的“隐形图书管理员”的角色,为我们建议下一部要观看的视频、下一首要聆听的歌曲或下一顿要订购的餐食。为了做好这一点,这些系统依赖于对所提供物品的深度理解。近年来,工程师们开始使用强大的人工智能模型,通过极其详尽的高维地图来描述这些物品。请想象一下,一个产品的描述不再是一个简单的标签,而是一个复杂的、多层级的肖像,包含了关于其外观、含义和语境的数千个独特细节。虽然这些丰富的描述有助于系统理解相似物品之间的细微差别,但它们也带来了沉重的代价。存储和处理数十亿件物品的这些庞大肖像需要如此多的计算机内存和能量,以至于它会拖慢整个系统的速度,使其在实际应用中变得过于缓慢且昂于成本。
为了解决这个问题,工程师们传统上尝试将这些详细的肖像压缩成微小的、离散的代码,就像将一张高分辨率照片压缩成一个微小的图标一样。然而,这种极端的压缩往往会使图像变得模糊,导致系统丢失区分不同物品所需的精细细节。这是一个艰难的权衡:是保留丰富的细节但减慢系统速度,还是缩小数据量但失去进行精准推荐所需的精确度。天津大学和美团的研究人员提出了一种新方法,试图寻找一个中间地带,使系统能够在保持详细描述丰富性的同时,以一种不牺牲准确性的空间高效方式进行存储。
研究人员开发了一种名为“基于稀疏激活的残差软量化”(Sparse Activation-based Residual Soft Quantization,简称 SA-RSQ)的方法。该框架不再强迫每个物品进入一个单一、僵化的类别或一个微小的固定代码,而是将物品的描述视为由少量关键构建块组成的灵活组合。这就像是在描述一种复杂的风味时,不是从字典中挑选一个单词,而是选择一小把配料并精确规定每种配料的使用量。系统会观察一个物品的高维描述,并从庞大的可能性库中识别出最相关的“配料”。然后,它仅存储这些被选中的配料名称以及它们混合的精确比例。
这种方法比以往的方法具有显著优势。旧技术通常被迫在单一代码或稠密数字块之间做出选择,从而导致细节流失或存储成本激增。然而,这种新方法将存储空间的大小与信息的复杂度解耦。通过仅存储描述中最重要的部分及其权重,系统可以在需要时重建高度准确的原物品肖像。至关重要的是,这个过程是可微的,这意味着系统可以直接从训练过程中收到的反馈中学习并改进其选择,而不是依赖于经常导致误差的粗略近似。
团队在一个来自外卖广告平台的庞大真实数据集上测试了这个框架,该数据集涉及数亿件物品。他们在严格的存储限制下(每件物品 8 字节到 48 字节不等)将其方法与几种现有的压缩技术进行了对比。结果显示,该方法始终优于其他方法。即使在受到极小存储容量的限制时,新方法也能保持更高的预测用户点击行为的准确度。当允许稍多一些空间(如 32 或 48 字节)时,性能进一步提升,并在所有测试方法中取得了最高分。该系统能够保留物品的细粒度细节,防止了旧压缩系统中常见的不同物品相互混淆的“碰撞”问题。
除了离线测试外,研究人员还在外卖平台上部署了该系统的在线实时实验。在为期一周的时间里,他们进行了一项受控测试,将新方法展示给一部分实际的用户流量。结果是切实的:使用该新框架的系统使用户的广告点击率增加了 2.51%,并使每千次展示产生的收入增加了 3.66%。这些收益是在没有降低系统速度的情况下实现的,证明了在不损失智能推荐所需的智能度的前提下,压缩复杂数据是可行的。
该研究还探索了一个潜在的未来应用场景,即系统不仅预测下一个单一物品,而且预测可能出现的下一个物品的概率分布,类似于语言模型预测句子中的下一个词。虽然这还处于初步调查阶段,但早期结果表明,这种概率方法可以很好地应用于生成式推荐任务,为这些系统如何演进开辟了新路径。研究人员指出,尽管结果令人鼓舞,但这些结果是基于专有数据和特定配置的,仍需进一步工作以确认这些发现是否适用于不同的领域。
最终,这项工作证明了存储效率与数据质量之间的僵化权衡并非不可避免。通过使用一种能够通过关键特征的加权组合来捕捉物品本质的灵活、稀疏的表示法,构建既快速又精准的推荐系统是可能的。该方法在真实工业环境中的成功表明,此类技术可以成为处理驱动数字世界的海量数据的标准工具,确保引导我们选择的系统能像其处理的信息一样,保持智能与细腻。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。