基于深度学习的POI及线路推荐算法的研究

来源 :黑龙江大学 | 被引量 : 0次 | 上传用户:studentOfJXUFE
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
随着社会的进步,移动互联网已经涉及到各行各业,移动电商和基于位置的社交网络(LBSN,Location-Based Social Networks)也得到了迅猛的发展,如淘宝,京东,Facebook,Twitter,Foursquare,Gowalla,Yelp等。与此同时,诸如信息爆炸问题也日益受到人们的关注,如何从逐日爆炸性增长的互联网海量数据中提取出对用户有实际意义的信息,同时尽可能地过滤不相关信息,成为了工业界和研究界的重要研究问题。而这也是推荐系统所要解决的问题。
  现阶段,推荐系统主要面临着如下的问题,第一数据稀疏性问题,因为我们可以收集到的用户和项目之间的交互数据很少,导致构建的用户项目交互矩阵过于稀疏,在这种情况下,想要利用稀疏的用户历史记录来通过推荐系统做出较为准确的推荐是极为困难的。第二冷启动问题,对于刚刚注册的新用户,由于其没有历史交互记录,推荐系统想要利用其历史交互记录来做出推荐的方案并不可行。现如今,人们开始使用用户与项目的附属信息(例如用户的社交关系,兴趣变化,职业方向,项目的地理位置,分类,评分,价格等)来缓解数据稀疏与冷启动问题。传统的推荐算法例如矩阵分解算法,往往只是利用用户向量与项目向量的点乘来预测概率的大小。但是这种只是通过线性关系来进行建模并不能反映出真实世界中复杂的非线性关系。随着深度学习技术在语音识别,自然语言处理等热点领域取得令人惊叹的成绩,本文也将使用深度学习技术来解决我们所提出的问题。
  针对上述提出的问题以及为了向用户提供更为准确的推荐,本文主要从以下三个方面进行研究:
  (1)研究基于自注意力机制的兴趣点推荐算法。本文提出了一种基于自注意力机制的模型(SSANet)来融合用户相似度和项目相似度。SSANet使用multi-hot对用户历史中的序列数据进行建模,得到用户嵌入表示;然后对POI附属信息进行建模,得到附属信息嵌入表示;接着将用户嵌入和附属信息嵌入的融合输出使用自注意力机制,从不同方面来学习用户历史的表示。实验表明,我们提出的模型相对于其他模型取得了显著的性能提升。
  (2)研究基于图注意力机制的兴趣点推荐算法。本文提出了一种基于图注意力机制的模型(SGANet),它能够无监督的学习用户偏好,同时基于会话窗口的方式来对用户的区域历史签到数据进行进一步的特征提取,并且引入了图注意力机制来捕获模型内部用户对POI对及区域POI的偏好程度,进一步通过融合POI附属信息以及利用循环神经网络GRU来学习用户的长期和短期偏好。通过一系列实验表明,我们提出的模型相对于其他模型取得了显著的性能提升。
  (3)研究基于生成式对抗网络的线路推荐算法。本文提出了一种基于生成式对抗网络机制的模型(RGANet)。由于用户的路线特征是序列数据,为了提取用户的线路特征,本文使用GRU来提取用户的线路特征。本文提出了三个模块,数据整合模块,线路生成模块,线路推荐模块。在生成器部分,根据限定条件生成路线,同时使用GRU来提取路线特征。在判别器部分,对用户的结构化POI序列同样使用GRU来提取路线特征,接着进行路线特征的相似度计算,使得生成器部分根据判别器部分的反馈生成用户满意度更高的路线。实验表明,我们提出的模型性能优于其他模型。
其他文献
伴随着国家政策对环保的重视,相关排放法规的要求越发严格,发展新能源汽车成为汽车行业的新方向。电动汽车作为新能源汽车的主要代表之一,受到了广泛的关注和重视。随着出行安全性和舒适性要求的逐渐提高,电动汽车ECU(Electronic Control Unit,电子控制单元)软件开发也面临着诸多挑战。中央控制单元是电动汽车重要的ECU之一,具有整车控制和远程监控功能,通过CAN(Controller A
学位
学位
学位
近年来,深度学习越来越多地被应用到各个领域,计算机与其他学科之间的交叉程度越来越大,而分子生成就是其中一个重要的部分。分子空间异常庞大,而已知的分子在其中不过是很小的一部分。为了发现更多潜在可用的新分子,近年来研究人员尝试利用深度学习的方法生成新分子,提出了大量的分子生成模型。这些分子生成模型通常要求输入与输出类型相同,即若输入是字符串则输出也是相同意义的字符串,若输入是邻接矩阵则输出也是邻接矩阵
学位
随着各种基因检测技术的发展,人类获得的数据越来越多,但是其中与特定疾病相关的基因数量却很少,人类现有的能力还是不能发现人体致病机理的秘密,本文研究的内容就是充分利用有限的资源来挖掘出可能致病的基因。现有的算法对复杂疾病的致病基因的发现能力较弱,深度学习却能很好的预测它们。由于推荐算法与致病基因发现任务具有相似性,所以本研究进行了借鉴和学习。本论文主要有以下三部分工作内容,首先,从海量基因中选择候选
显著性目标检测是从一幅图像中检测出前景的轮廓,其在深度学习中具有广泛的用途,是很多计算机视觉任务的首要工作。由于越来有多的任务都需要依靠显著性目标检测来完成,最近几年这个任务成为了人工智能热门的研究方向。现有的方法在检测简单的场景时效果非常的好。然而,针对一些复杂场景,例如图像中包含不规则目标、多目标、小目标等场景,或者目标边界轮廓比较复杂等情况,现有的检测方法无法有效的处理这些问题。很多方法预测
随着计算机和互联网的飞快发展,百度、新浪、字节跳动和网易等互联网企业也快速发展起来。伴随着互联网企业的快速发展大量的数据喷涌而来,信息过载导致用户不能快速的筛选对自己有帮助的信息。为此,研究者们开始着力于开发推荐系统帮助用户进行决策。推荐算法包括传统推荐算法和基于深度学习的推荐算法。目前,传统的推荐算法和基于深度学习的推荐算法面临的挑战都是数据稀疏和冷启动。数据稀疏是由于用户项目之间的交互数据过少
学位
伴随着移动互联网和大数据的高速发展,互联网产生大量的数据,这些海量的数据在给我们带来丰富选择的同时,也给我们带来了信息过载的问题。推荐系统旨在根据用户和项目之间的交互历史来自动构架用户和项目的之间的联系。学术和工业界的研究表明,推荐系统能够有效解决信息过载问题,提升数据的利用率。然而传统的推荐算法受限于有限的附属信息和模型结构,无法实现理想的效果,而且非常容易受到数据稀疏的影响,尤其是冷启动问题。
学位
睡眠是一种复杂的生理活动过程,充足的睡眠时间和高质量的睡眠质量是人体生理健康和心理健康的必要条件。睡眠障碍严重影响人类健康和生活,将睡眠阶段准确的分类是检测和治疗睡眠障碍的关键,睡眠阶段分类也称之为睡眠分期。在睡眠分期领域,主流的深度学习方法在同一层次上仅仅使用了某种单一的关系归纳偏置,这会使得深度学习方法的特征提取方式不够完备并导致该方法的性能受到限制。本文使用平移不变性、时间不变性和分层处理等
学位
开发一种治疗疾病的新药是一种非常漫长和昂贵的过程,为已知药物确定新的疾病适应症,即药物重定位,有助于减少药物的研发成本。目前,大多预测药物相关疾病的方法都是综合利用与药物和疾病相关的数据。然而这些方法虽然聚焦在整合多种药物特征,并没有考虑到各种特征间的多样性。此外这些方法尽管利用了药物和疾病相关的各种数据,但是它们都是根据浅层模型提出的,很难挖掘出药物和疾病之间复杂的关联关系。这些不足将在一定程度