京公网安备 11010802034615号
经营许可证编号:京B2-20210330
为用户提供建议的平台。协同过滤算法是推荐系统中使用的主要算法之一。这种算法简单、高效;然而,数据的稀疏性和方法的可扩展性限制了这些算法的性能,并且很难进一步提高推荐结果的质量。因此,提出了一种将协同过滤推荐算法与深度学习技术相结合的模型,其中包括两部分。首先,该模型采用基于二次多项式回归模型的特征表示方法,通过改进传统的矩阵因子分解算法,更准确地获得潜在特征。这些潜在特征被认为是深层神经网络模型的输入数据。该模型的第二部分,用于预测评价分数。最后,通过与其他三个公共数据集的推荐算法进行比较,验证了我们的模型可以有效地提高推荐性能。
随着人工智能技术的发展,越来越多的智能产品正在被应用。日常生活,为各种各样的人提供方便。个性化推荐系统的智能推荐功能可以有效地为用户提供服务。从海量的互联网数据中获取有价值的
推荐算法是推荐系统中最重要的部分,直接决定推荐结果的质量和性能。的系统。常用的算法可以分为两大类:基于内容的[1]方法和协同过滤[2]-[4]方法。基于内容的方法通过对额外信息(如文档内容、用户配置文件和项目属性)的分析来构建用户和项目的肖像(描述),从而提出建议。在大多数情况下,用来构建肖像的信息很难获得甚至是伪造的;因此,它的性能而且应用范围受到很大的限制。协同过滤算法是推荐系统中应用最广泛的算法;它们是不同的从基于内容的方法中,他们不需要关于用户或项目的信息,他们只基于用户和诸如点击、浏览和评级等项目的交互信息做出准确的推荐。虽然该方法简单有效,随着互联网的快速发展,数据的稀疏性限制了算法的性能;因此,研究人员已经开始寻找其他方法来提高推荐性能。
近年来,深度神经网络(DNNs)在计算机视觉[5]、语音识别[6]、自然语言处理[7]等各个领域取得了巨大的成功。然而,对这些技术的推荐系统研究很少。一些研究人员
最近提出的基于深度学习的推荐模型,但大多数模型都使用了附加的特性,比如文本内容和音频信息,以提高它们的性能。鉴于上述信息可能难以获得大多数推荐系统,本文提出了一种基于DNNs的推荐模型,该模型不需要除了用户和项目之间的交互之外的任何额外信息。我们模型的主要框架如图1所示。首先,我们使用用户项目评级矩阵来获取用户和项目的特性,我们将在第3节中讨论。然后,我们将这些特征作为神经网络的输入。在输出层中,我们将获得一些概率值,这些值表示用户可能给出的分数的概率。最后,以概率最高的分数作为预测结果。通过对三种公共数据集的常用和最先进的算法进行比较,证明该模型能够有效地提高推荐精度。
本文的其余部分组织如下:在第2节中,我们介绍了基于DNNs的CF方法和一些推荐算法。我们将在第3节详细描述我们的模型。第4节包含一些实验评估和讨论。在第5节中我们提供了一个简短的结论。
Breese等[8]将CF算法分为两类:基于内存的方法和基于模型的方法。基于内存的CF使用用户[9]或项目[10]之间的相似性来提出建议。由于该方法有效且易于实现,因此得到了广泛的应用,但随着推荐系统规模的增大,相似度的计算也变得越来越困难;此外,高数据稀疏性也限制了该方法的性能。
为了解决上述问题,提出了许多基于模型的推荐算法,如潜在语义模型[11]、贝叶斯模型[12]、基于回归的模型[13]、聚类模型[14]、矩阵因子分解模型[15]。在各种CF技术中,矩阵分解是最常用的方法。该方法将用户和项映射到具有相同维度的向量,该维度表示用户或项的潜在特性。该方法的代表性工作包括非参数概率主成分分析(NPCA)[16]、奇异值分解(SVD)[17]、概率矩阵分解(PMF)[18]。然而,通过矩阵分解方法学习的潜在特征往往不够有效,特别是当评价矩阵非常稀疏的时候。
另一方面,深度学习技术最近在计算机视觉和自然语言处理领域取得了巨大的成功。这些技术在学习特征表现方面表现出极大的潜力;因此,研究人员已经开始将深度学习方法应用于推荐领域。Salakhutdinov等[19]使用受限的玻尔兹曼机代替传统的矩阵分解来执行CF,而Georgiev和Nakov[20]通过合并两者之间的关联来扩展工作。用户和项目之间。还有其他一些基于深度学习的研究方法,但他们主要关注[21]和[22]等音乐推荐。这些研究分别使用传统的卷积神经网络和深度信任网络来学习音乐的内容特征。除了音乐推荐,Wang等[23]提出了采用深度学习模型获取内容特征的层次贝叶斯模型,并采用传统的CF模型来处理评级信息。正如我们所看到的,这些基于深度学习技术的方法或多或少地通过学习诸如文本内容之类的内容特征来提出建议。以及音乐的光谱。当我们无法获得物品的内容时,这些方法是不适用的。因此,他等[24]提出了一种基于深度学习的新的推荐框架。在他们的方法中,用户和项目通过其ID的一热编码表示;显然,该方法只在模型的训练阶段使用ID信息,这使得大量的先验信息无法使用。因此,特征学习的有效性难以保证。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
机器学习的本质,是让模型通过对数据的学习,自主挖掘规律、实现预测与决策,而这一过程的核心驱动力,并非单一参数的独立作用, ...
2026-03-27在SQL Server数据库操作中,日期时间处理是高频核心需求——无论是报表统计中的日期格式化、数据筛选时的日期类型匹配,还是业务 ...
2026-03-27在CDA(Certified Data Analyst)数据分析师的能力体系与职场实操中,高维数据处理是高频且核心的痛点——随着业务场景的复杂化 ...
2026-03-27在机器学习建模与数据分析实战中,特征维度爆炸、冗余信息干扰、模型泛化能力差是高频痛点。面对用户画像、企业经营、医疗检测、 ...
2026-03-26在这个数据无处不在的时代,数据分析能力已不再是数据从业者的专属技能,而是成为了职场人、管理者、创业者乃至个人发展的核心竞 ...
2026-03-26在CDA(Certified Data Analyst)数据分析师的能力体系中,线性回归是连接描述性统计与预测性分析的关键桥梁,也是CDA二级认证的 ...
2026-03-26在数据分析、市场研究、用户画像构建、学术研究等场景中,我们常常会遇到多维度、多指标的数据难题:比如调研用户消费行为时,收 ...
2026-03-25在流量红利见顶、获客成本持续攀升的当下,营销正从“广撒网”的经验主义,转向“精耕细作”的数据驱动主义。数据不再是营销的辅 ...
2026-03-25在CDA(Certified Data Analyst)数据分析师的全流程工作中,无论是前期的数据探索、影响因素排查,还是中期的特征筛选、模型搭 ...
2026-03-25在当下数据驱动决策的职场环境中,A/B测试早已成为互联网产品、运营、营销乃至产品迭代优化的核心手段,小到一个按钮的颜色、文 ...
2026-03-24在统计学数据分析中,尤其是分类数据的分析场景里,卡方检验和显著性检验是两个高频出现的概念,很多初学者甚至有一定统计基础的 ...
2026-03-24在CDA(Certified Data Analyst)数据分析师的日常业务分析与统计建模工作中,多组数据差异对比是高频且核心的分析场景。比如验 ...
2026-03-24日常用Excel做数据管理、台账维护、报表整理时,添加备注列是高频操作——用来标注异常、说明业务背景、记录处理进度、补充关键 ...
2026-03-23作为业内主流的自助式数据可视化工具,Tableau凭借拖拽式操作、强大的数据联动能力、灵活的仪表板搭建,成为数据分析师、业务人 ...
2026-03-23在CDA(Certified Data Analyst)数据分析师的日常工作与认证考核中,分类变量的关联分析是高频核心场景。用户性别是否影响商品 ...
2026-03-23在数据工作的全流程中,数据清洗是最基础、最耗时,同时也是最关键的核心环节,无论后续是做常规数据分析、可视化报表,还是开展 ...
2026-03-20在大数据与数据驱动决策的当下,“数据分析”与“数据挖掘”是高频出现的两个核心概念,也是很多职场人、入门学习者容易混淆的术 ...
2026-03-20在CDA(Certified Data Analyst)数据分析师的全流程工作闭环中,统计制图是连接严谨统计分析与高效业务沟通的关键纽带,更是CDA ...
2026-03-20在MySQL数据库优化中,分区表是处理海量数据的核心手段——通过将大表按分区键(如时间、地域、ID范围)分割为多个独立的小分区 ...
2026-03-19在商业智能与数据可视化领域,同比、环比增长率是分析数据变化趋势的核心指标——同比(YoY)聚焦“长期趋势”,通过当前周期与 ...
2026-03-19