搜索关键字：hadoop eclipse拒绝连接，搜索到13955个结果！码迷,mamicode.com！

为什么要使用Spark？

现有的hadoop生态系统中存在的问题1）使用mapreduce进行批量离线分析；2）使用hive进行历史数据的分析；3）使用hbase进行实时数据的查询；4）使用storm进行实时的流处理；5）。。。。。。导致：维护成本高、学习成本高Spark的出现弥补了Hadoop生态系统中的缺陷，使用spar...

分类：其他好文时间：2014-06-28 14:08:46 阅读次数：306

Spark Standalone模式环境搭建

前提：安装好jdk1.7，hadoop安装步骤：1、安装scala下载地址：http://www.scala-lang.org/download/配置环境变量：export SCALA_HOME=/..../scalaexport PATH=.:$SCALA_HOME/bin ....验证：sca....

分类：其他好文时间：2014-06-28 14:08:09 阅读次数：404

Hadoop与HBase中遇到的问题

1. Hadoop中遇到的问题曾经所遇到的问题因为没有记录,所以忘了(1)NameNode没有启动成功, 是因为你对HDFS多次格式化,导致datanode中与namenode中的VERSION文件里的namespaceID不一致(对于NameNode节点,该文件位于hdfs-site配置文件里df...

分类：其他好文时间：2014-06-28 12:47:08 阅读次数：394

Hadoop技术内幕——Hadoop配置信息处理

配置系统是复杂软件必不可少的一部分，org.apache.hadoop.conf.Configuration在Hadooop各个子项目中发挥着重要作用。 windows系统广泛使用一种特殊批的ASCII文件.ini作为其主要配置文件标准，被称为（Initialization File）或概要文...

分类：其他好文时间：2014-06-24 09:11:43 阅读次数：248

HBase的常用Java API

1. 创建HBase表的对象HBase表的对项名字叫HTable，创建它的方法有很多，常见的有如下：org.apache.hadoop.hbase.client.HTable hTable = new HTable(org.apache.hadoop.hbase.HBaseConfiguration...

分类：编程语言时间：2014-06-23 08:32:23 阅读次数：386

Spark

Spark已正式申请加入Apache孵化器，从灵机一闪的实验室“电火花”成长为大数据技术平台中异军突起的新锐。本文主要讲述Spark的设计思想。Spark如其名，展现了大数据不常见的“电光石火”。具体特点概括为“轻、快、灵和巧”。轻：Spark 0.6核心代码有2万行，Hadoop 1.0为9万行，...

分类：其他好文时间：2014-06-23 07:25:53 阅读次数：418

Hadoop0.21.0部署安装以及mapreduce测试

鉴于hadoop的需要。。。但是并不限于此。。。有时候闲输入密码麻烦，也可以用这种办法从一个节点通过ssh进入另一个节点。。。设要使master进入slave是免密码的，则可以在master（ip为192.168.169.9）中如下操作：命令：ssh-keygen -t rsa 然后一路回车（该命令...

分类：其他好文时间：2014-06-22 23:31:51 阅读次数：332

Hadoop使用心得

最近在学Hadoop，的确是个好东西，内部原理的确很难理解，不过用起来还是比较方便的因为刚接触，一些指令还是写记下hadoop fs -rmr 每次运行前都要删除输出目录hadoop jar target/Test-1.0-SNAPSHOT.jar javaPath运行hadoop程序hadoop ...

分类：其他好文时间：2014-06-22 23:10:26 阅读次数：237

Hadoop学习资料整理

hadoop 0.18文档（详细介绍Hadoop，MapReduce，FS Shell，Streaming等）hadoop资料汇总（XX搜集的，还没看）streaming（非java程序员的福音）Hadoop Streaming编程实例Hadoop Streaming编程Hadoop Streami...

分类：其他好文时间：2014-06-20 18:33:43 阅读次数：160

开源日志系统比较：scribe、chukwa、kafka、flume

1. 背景介绍许多公司的平台每天会产生大量的日志（一般为流式数据，如，搜索引擎的pv，查询等），处理这些日志需要特定的日志系统，一般而言，这些系统需要具有以下特征：（1）构建应用系统和分析系统的桥梁，并将它们之间的关联解耦；（2）支持近实时的在线分析系统和类似于Hadoop之类的离线分析系统；（...

分类：其他好文时间：2014-06-20 16:18:14 阅读次数：294

共13955条上一页 1 ... 1354 1355 1356 1357 1358 ... 1396 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)