京公网安备 11010802034615号
经营许可证编号:京B2-20210330
为用户提供建议的平台。协同过滤算法是推荐系统中使用的主要算法之一。这种算法简单、高效;然而,数据的稀疏性和方法的可扩展性限制了这些算法的性能,并且很难进一步提高推荐结果的质量。因此,提出了一种将协同过滤推荐算法与深度学习技术相结合的模型,其中包括两部分。首先,该模型采用基于二次多项式回归模型的特征表示方法,通过改进传统的矩阵因子分解算法,更准确地获得潜在特征。这些潜在特征被认为是深层神经网络模型的输入数据。该模型的第二部分,用于预测评价分数。最后,通过与其他三个公共数据集的推荐算法进行比较,验证了我们的模型可以有效地提高推荐性能。
随着人工智能技术的发展,越来越多的智能产品正在被应用。日常生活,为各种各样的人提供方便。个性化推荐系统的智能推荐功能可以有效地为用户提供服务。从海量的互联网数据中获取有价值的
推荐算法是推荐系统中最重要的部分,直接决定推荐结果的质量和性能。的系统。常用的算法可以分为两大类:基于内容的[1]方法和协同过滤[2]-[4]方法。基于内容的方法通过对额外信息(如文档内容、用户配置文件和项目属性)的分析来构建用户和项目的肖像(描述),从而提出建议。在大多数情况下,用来构建肖像的信息很难获得甚至是伪造的;因此,它的性能而且应用范围受到很大的限制。协同过滤算法是推荐系统中应用最广泛的算法;它们是不同的从基于内容的方法中,他们不需要关于用户或项目的信息,他们只基于用户和诸如点击、浏览和评级等项目的交互信息做出准确的推荐。虽然该方法简单有效,随着互联网的快速发展,数据的稀疏性限制了算法的性能;因此,研究人员已经开始寻找其他方法来提高推荐性能。
近年来,深度神经网络(DNNs)在计算机视觉[5]、语音识别[6]、自然语言处理[7]等各个领域取得了巨大的成功。然而,对这些技术的推荐系统研究很少。一些研究人员
最近提出的基于深度学习的推荐模型,但大多数模型都使用了附加的特性,比如文本内容和音频信息,以提高它们的性能。鉴于上述信息可能难以获得大多数推荐系统,本文提出了一种基于DNNs的推荐模型,该模型不需要除了用户和项目之间的交互之外的任何额外信息。我们模型的主要框架如图1所示。首先,我们使用用户项目评级矩阵来获取用户和项目的特性,我们将在第3节中讨论。然后,我们将这些特征作为神经网络的输入。在输出层中,我们将获得一些概率值,这些值表示用户可能给出的分数的概率。最后,以概率最高的分数作为预测结果。通过对三种公共数据集的常用和最先进的算法进行比较,证明该模型能够有效地提高推荐精度。
本文的其余部分组织如下:在第2节中,我们介绍了基于DNNs的CF方法和一些推荐算法。我们将在第3节详细描述我们的模型。第4节包含一些实验评估和讨论。在第5节中我们提供了一个简短的结论。
Breese等[8]将CF算法分为两类:基于内存的方法和基于模型的方法。基于内存的CF使用用户[9]或项目[10]之间的相似性来提出建议。由于该方法有效且易于实现,因此得到了广泛的应用,但随着推荐系统规模的增大,相似度的计算也变得越来越困难;此外,高数据稀疏性也限制了该方法的性能。
为了解决上述问题,提出了许多基于模型的推荐算法,如潜在语义模型[11]、贝叶斯模型[12]、基于回归的模型[13]、聚类模型[14]、矩阵因子分解模型[15]。在各种CF技术中,矩阵分解是最常用的方法。该方法将用户和项映射到具有相同维度的向量,该维度表示用户或项的潜在特性。该方法的代表性工作包括非参数概率主成分分析(NPCA)[16]、奇异值分解(SVD)[17]、概率矩阵分解(PMF)[18]。然而,通过矩阵分解方法学习的潜在特征往往不够有效,特别是当评价矩阵非常稀疏的时候。
另一方面,深度学习技术最近在计算机视觉和自然语言处理领域取得了巨大的成功。这些技术在学习特征表现方面表现出极大的潜力;因此,研究人员已经开始将深度学习方法应用于推荐领域。Salakhutdinov等[19]使用受限的玻尔兹曼机代替传统的矩阵分解来执行CF,而Georgiev和Nakov[20]通过合并两者之间的关联来扩展工作。用户和项目之间。还有其他一些基于深度学习的研究方法,但他们主要关注[21]和[22]等音乐推荐。这些研究分别使用传统的卷积神经网络和深度信任网络来学习音乐的内容特征。除了音乐推荐,Wang等[23]提出了采用深度学习模型获取内容特征的层次贝叶斯模型,并采用传统的CF模型来处理评级信息。正如我们所看到的,这些基于深度学习技术的方法或多或少地通过学习诸如文本内容之类的内容特征来提出建议。以及音乐的光谱。当我们无法获得物品的内容时,这些方法是不适用的。因此,他等[24]提出了一种基于深度学习的新的推荐框架。在他们的方法中,用户和项目通过其ID的一热编码表示;显然,该方法只在模型的训练阶段使用ID信息,这使得大量的先验信息无法使用。因此,特征学习的有效性难以保证。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
CDA数据分析师 出品 作者:李诗怡 1. 销售漏斗阶段判断 题目:销售漏斗模型中,通过广告、社交媒体等方式触达品牌信息(如浏览品 ...
2026-09-07在Python数据分析中,Pandas库的DataFrame是最核心、最常用的结构化数据表对象,类似于Excel的二维表格,具备规整的行列结构、字 ...
2026-09-07在数据分析、经营复盘、业绩预测与经济统计工作中,平均增速(平均增长率)是衡量数据长期变化趋势、业务发展快慢的核心指标。不 ...
2026-09-07 很多数据分析师精通Excel单元格操作,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质区别”“为什么表结 ...
2026-09-07随着大数据技术的快速发展,商业竞争逐步从传统的经验式经营转变为数据驱动的精细化运营。海量的用户行为数据、交易数据、运营数 ...
2026-09-04CDA数据分析师 出品 作者:李诗怡 1. 波士顿矩阵(BCG Matrix) 定义: BCG于1970年提出的业务组合分析工具,以"市场增长率"(纵 ...
2026-09-04 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-09-04数据透视表是Excel与Power BI中最核心的数据分析工具,具备快速汇总、维度拆分、动态筛选的能力,可高效完成数据归类与统计展示 ...
2026-09-03在Power BI数据分析可视化场景中,堆积柱状图+折线图是最常用的复合图表组合。堆积柱状图适合展示各细分维度当期数值、结构占比 ...
2026-09-03 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据的基本处理单位是什么”“数据类型误判会引发哪些分析错误”“ ...
2026-09-03CDA数据分析师 出品 作者:李诗怡 一、8个核心数据清洗函数 1. TRIM:一键清除多余空格(最常用) 作用:仅保留文本中"单词/字 ...
2026-09-02数据分析的核心并非单纯操作工具、整理报表或绘制图表,而是依靠科学的思维逻辑挖掘数据价值、解释业务现象、指导经营决策。在完 ...
2026-09-02在社会经济、产业研究、区域治理与大数据实证分析中,面板数据是最具研究价值的数据类型。面板数据同时包含截面维度与时间维度信 ...
2026-09-02 很多数据分析师能熟练计算均值、标准差,但当被问到“如何用一张图让业务方3秒内看懂核心结论”“面对不同数据类型该怎么选 ...
2026-09-02在数据驱动决策的体系中,数据分析按照分析目的可分为描述性分析、诊断性分析、预测性分析与指导性分析四大类型。其中,诊断性分 ...
2026-09-01网络请求是Python爬虫开发、接口测试、数据拉取的核心基础功能,Python生态中主要依靠 urllib 和 requests 两大库实现HTTP请求操 ...
2026-09-01 很多数据分析师面对业务问题时,常常感到“知道要分析,却不知道用什么方法”。其实,数据分析并非无章可循——从三大基础范 ...
2026-09-01在数据库设计与业务数据维护中,自增ID是数据表最常用的主键字段,用于唯一标识每一条业务数据,正常状态下ID应保持连续递增。但 ...
2026-08-31在数理统计、数据分析、经济测算与日常量化评估中,平均值是刻画数据集中趋势、反映整体水平的基础核心指标。在实际应用中,最常 ...
2026-08-31在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-08-31