面向Spark的图书借阅数据关联模型的研究 |
| |
引用本文: | 高琪娟,刘锴,陈佳.面向Spark的图书借阅数据关联模型的研究[J].安徽农业大学学报,2018,45(4):768-771. |
| |
作者姓名: | 高琪娟 刘锴 陈佳 |
| |
作者单位: | 安徽农业大学信息与计算机学院,合肥,230036;安徽农业大学现代教育信息中心,合肥,230036;中国电信芜湖分公司高端聚类服务中心,芜湖,241003 |
| |
基金项目: | 国家自然科学青年科学基金项目(31601741)和安徽省高等学校自然科学研究重点项目(KJ2016A221)资助。 |
| |
摘 要: | 为了方便读者能在海量的图书资源中快速有效的找到需要的书籍,利用Map Reduce框架分块处理,结合关联分析Apriori算法,将数据挖掘技术应用到图书管理系统中。但需要多次扫描数据库和产生大量候选集,对Hadoop平台处理速度带来了巨大挑战,因此,针对传统的Apriori算法,提出基于内存计算、弹性分布式数据集处理的Spark平台为读者推荐书籍,指引读者的借阅行为。
|
关 键 词: | Apriori关联规则 Spark平台 图书借阅行为模式 频繁项集 |
本文献已被 CNKI 万方数据 等数据库收录! |
| 点击此处可从《安徽农业大学学报》浏览原始摘要信息 |
| 点击此处可从《安徽农业大学学报》下载免费的PDF全文 |
|