码迷,mamicode.com
首页 > 其他好文 > 详细

大数据应用技术课程实践--选题与实践方案

时间:2020-06-23 21:21:52      阅读:66      评论:0      收藏:0      [点我收藏+]

标签:analysis   enter   情况   nal   charts   cli   导入   linux操作系统   安装   


一、选题与意义

1.Hadoop平台应用

2.Kaggle分析数据项目

简要说明理由与意义。

答:我选择Hadoop平台应用-淘宝双11数据分析与预测,以前接触过Hadoop,但是有点忘记,可以重新复习一下,进一步熟悉linux命令,。

二、实践方案

简要说明理由。

答:个人电脑安装实验环境。

三、实践任务分解

根据所选的题目,明确实验步骤,分解任务到每天。

  1. 安装Linux操作系统
  2. 安装关系型数据库MySQL
  3. 安装大数据处理框架Hadoop
  4. 安装数据仓库Hive
  5. 安装Sqoop
  6. 安装Eclipse
  7. 安装 Spark
  8. 对文本文件形式的原始数据集进行预处理
  9. 把文本文件的数据集导入到数据仓库Hive中
  10. 对数据仓库Hive中的数据进行查询分析
  11. 使用Sqoop将数据从Hive导入MySQL
  12. 利用Eclipse搭建动态Web应用
  13. 利用ECharts进行前端可视化分析
  14. 利用Spark MLlib进行回头客行为预测

四、实践计划

按任务分解撰写计划表,每天按计划表开展工作。

第天根据实际情况更新计划表,有必要时调整。

 技术图片

 

 

1.

 

大数据平台安装软件:

链接:https://pan.baidu.com/s/1lZM6BkZ6XoRE3uwepsQ_5A 
提取码:ao1m

虚拟机镜像文件:

链接:https://pan.baidu.com/s/1e0qak_9Uymn_R1HmSu5ZLw  
提取码:q0lt 

大数据应用技术课程实践--选题与实践方案

标签:analysis   enter   情况   nal   charts   cli   导入   linux操作系统   安装   

原文地址:https://www.cnblogs.com/zengyf/p/13184150.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!