1、大数据有哪些特点? valume(大量) velocity(高速) variety(多样) value(低价值密度) 2、什么是大数据? 指无法在一定的时间范围内用常规软件工具进行捕捉、管理和处理的数据集合,是需要新处理模式才具有更强的决策力、洞察发现力和流程优化能力的海量、高增长率和多样化的信 ...
分类:
其他好文 时间:
2020-11-16 13:51:20
阅读次数:
9
Rowkey设计时需要遵循三大原则: 1. 唯一性原则 rowkey在设计上保证其唯一性。rowkey是按照字典顺序排序存储的,因此,设计rowkey的时候,要充分利用这个排序的特点,将经常读取的数据存储到一块,将最近可能会被访问的数据放到一块。 2. 长度原则 rowkey是一个二进制码流,可以是 ...
分类:
其他好文 时间:
2020-11-13 13:05:38
阅读次数:
7
1.环境的安装与准备 参考下图: 2.数据库服务的安装与添加(HADOOP,HDFS,HIVE) 如下图所示: 3.华为官网的文档的指导手册(HADOOP,HDFS,HIVE) FusionInsight HD 6.5.1 应用开发指南 03 https://support.huawei.com/e ...
分类:
数据库 时间:
2020-11-13 12:11:51
阅读次数:
18
本周因为一些原因实际开发时间过于零散,因而开发报告未按每日进行总结 但是本周进展也说不上多,这点不太好 花在学习上:20小时 花在代码上:15小时 花在解决问题上:9小时 本周遇到的问题:Hadoop可以正常启动 但是Namenode无法通过浏览器访问(连接被拒绝),离谱的是Secondary Na ...
分类:
其他好文 时间:
2020-11-12 13:43:39
阅读次数:
7
本周主要是制作了河北重大技术需求分析的数据录入板块,通过这个主要是练习了前端的制作,例如通过js以及json数据进行多级联动,还有一些特殊条件的查询等等。另外就是软件需求的分析,对于客户提出的要求我们作为软件的设计者以现有技术为根基来进行设计,设计出尽可能合理的系统,并针对其中的诸多细节与客户进行交 ...
分类:
其他好文 时间:
2020-11-12 13:30:08
阅读次数:
9
软件行业流行一句话:“不想当架构师的程序员,不是一个好的程序员。” 看似是一种调侃,但从职业发展的层面讲,成为架构师,是一个目标! 我是王波,一名软件架构师,精通Java互联网技术开发和实践。 成功开发过基于通信、电商、数据管理、OA、ERP、SAAS等相关业务平台的项目。 给大家介绍一下我的Jav ...
分类:
编程语言 时间:
2020-11-10 10:56:13
阅读次数:
24
Hadoopnamenode高可用性分析:QJM核心源代码解读背景介绍HDFSnamenode在接受写操作时会记录日志,最早HDFS日志写本地,每次重启或出现故障后重启,通过本地镜像文件+操作日志,就能还原到宕机之前的状态,不会出现数据不一致。如果要做高可用(HA),日志写在单个机器上,这个机器磁盘出现问题,重启就恢复不了,导致数据不一致,出现的现象就是新建的文件不存在,删除成功的还在等诡异现象。
分类:
其他好文 时间:
2020-11-07 17:00:30
阅读次数:
24
1.词频统计 a.下载喜欢的电子书或大量文本数据,并保存在本地文本文件中 b.编写map与reduce函数 c.本地测试map和reduce d.将文本数据上传到HDFS上 e.用hadoop streaming提交任务 f.查看运行结果 g.计算结果取回本地 ...
分类:
其他好文 时间:
2020-11-07 16:36:45
阅读次数:
33
1.下载喜欢的电子书或大量文本数据,并保存在本地文件夹中 2.编写map与reduce函数 3.本地测试map与reduce 4.将文本数据上传至HDFS上 5.用hadoop streaming提交任务 6.查看运行结果 7.计算结果取回到本地 ...
分类:
其他好文 时间:
2020-11-07 16:32:22
阅读次数:
17
1.下载喜欢的电子书或大量文本数据,并保存在本地文本文件中 2编写map与reduce函数 3本地测试map与reduce 4将文本数据上传至HDFS上 5.用hadoop streaming提交任务 6.查看运行结果 7.计算结果取回到本地 ...
分类:
其他好文 时间:
2020-11-07 16:17:20
阅读次数:
18