搜索关键字：hadoop hdp ambari 大数据 lzo 安装配置 hdp，搜索到32863个结果！码迷,mamicode.com！

Maven的安装与使用,JAVA代码上线流程

安装配置环境变量,是mvn命令可执行 source /etc/profile 上传java代码,解压,进到代码目录,执行mvn package打包,执行过程中会进到apache仓库下载依赖进行打包打包完成后,出现一个target文件夹,里面有一个jar包 mvn clean 先清除,后打包 mv ...

分类：编程语言时间：2021-03-31 11:45:20 阅读次数：0

Kafka 概述

1.1 定义 Kafka 是一个分布式的基于发布/订阅模式的消息队列（Message Queue），主要应用于大数据实时处理领域 1.2 消息队列 1.2.1 传统消息队列的应用场景 ? 使用消息队列的好处 1）解耦允许你独立的扩展或修改两边的处理过程，只要确保它们遵守同样的接口约束。 2） ...

分类：其他好文时间：2021-03-30 13:07:59 阅读次数：0

Hadoop集群--linux虚拟机JDK安装与配置

Hadoop集群第三章 linux虚拟机 jdk 配置 1、查看并卸载主机原有JDK 1）查找并卸载 jdk 相关软件 rpm -qa | grep -i java | xargs -n1 rqm -e --nodeps rpm -qa：查看安装的所有 rpm 软件包 grep -i ：忽略大小写 ...

分类：系统相关时间：2021-03-29 12:39:22 阅读次数：0

有必要了解的大数据知识(二) Hadoop

前言接上文，复习整理大数据相关知识点，这章节从MapReduce开始... MapReduce介绍 MapReduce思想在生活中处处可见。或多或少都曾接触过这种思想。MapReduce的思想核心是“分而治之”，适用于大量复杂的任务处理场景（大规模数据处理场景）。 Map负责“分”，即把复杂的任务 ...

分类：其他好文时间：2021-03-17 15:09:28 阅读次数：0

中国DLP获Gartner认可！关于DLP应用，技术大咖齐成岳这样说

处在数字化时代的浪潮中，相信大家对于“数据”都不会陌生。无论对于企业还是个人，数据已经成为了数字化时代的“石油”。早在几年前马云就曾提出过一个观点——未来将会实现从IT时代向DT时代的变革。而在几年后的今天，我们切实感受到了大数据所带来的滚滚红利。 ? 在享受大数据红利的同时，也同样要注意数据的安全 ...

分类：其他好文时间：2021-03-17 14:23:44 阅读次数：0

大数据技术01---学习路径

大数据技术板块划分数据采集 flume kafka logstash filebeat ... 数据存储 mysql redis hbase hdfs ... 虽然mysql不属于大数据范畴但是我在这也列出来了，因为你在工作中离不开它数据查询 hive impala elasticsearch ...

分类：其他好文时间：2021-03-17 14:04:41 阅读次数：0

nginx安装，配置，及高可用

nginx功能：反向代理、负载均衡，动静分离，安装nginx方式参考：https://www.runoob.com/linux/nginx-install-setup.html 一、nginx配置负载均衡提供了以下几种分配策略： 1.轮询（默认）每个请求按照时间顺序逐一分配到不同的后端服务器，如果 ...

分类：其他好文时间：2021-03-16 13:43:20 阅读次数：0

虚拟机快速下载安装配置aarch64-linux-gnu-gcc工具链

方式一:软件仓库安装此方法不用自己去配置交叉编译工具链 1.查看本地仓库有支持哪些版本哪些输入命令: apt-cache search aarch64 2.下载安装 gcc-8-aarch64-linux-gnu 输入:sudo apt-get install gcc-8-aarch64-lin ...

分类：系统相关时间：2021-03-16 13:38:58 阅读次数：0

02 Spark框架与运行流程

1、为什么要引入Yarn和Spark。 (1)现有的hadoop生态系统中存在的问题 1）使用mapreduce进行批量离线分析； 2）使用hive进行历史数据的分析； 3）使用hbase进行实时数据的查询； 4）使用storm进行实时的流处理； (2)选用spark的原因 1）应用于流式计算的S ...

分类：其他好文时间：2021-03-16 13:32:12 阅读次数：0

01 Spark架构与运行流程

1. 阐述Hadoop生态系统中，HDFS, MapReduce, Yarn, Hbase及Spark的相互关系，为什么要引入Yarn和Spark。 HDFS是Hadoop体系中数据存储管理的基础，它是一个高度容错的系统，能检测和应对硬件故障，在低成本的通用硬件上运行。 HBase构建在HDFS之上 ...

分类：其他好文时间：2021-03-16 13:21:18 阅读次数：0

共32863条上一页 1 ... 14 15 16 17 18 ... 3287 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)