搜索关键字：hadoop hdfs命令，搜索到13969个结果！码迷,mamicode.com！

java下的多线程操作工具类（原创）

因为毕业设计上需要将控制台的任务实时输出到界面上，而且那是个Hadoop的mapreduce任务，一跑半个小时的节奏，所以需要用到多线程并随时读取返回的数据，百度了没找到合适的方法，于是被逼无奈编写了这个十分简单的多线程操作工具类。大概的功能就是可以执行一个特定的线程（线程必须调用本类的方法才能实现...

分类：编程语言时间：2014-05-15 21:50:11 阅读次数：366

Hadoop的安装(Ubuntu 12.10为例)

1. JDK安装a) 安装目录：网上的安装JDK资料中安装目录基本有两种——/opt和/usr/local。这两个目录安装在哪里其实都无所谓，只不过在以前的linux中人们习惯将软件安装在/usr/local中。这里推荐/opt目录。b) 配置文件：将JDK同时配置在/etc/profile和/et...

分类：其他好文时间：2014-05-15 21:46:37 阅读次数：388

非结构化数据的存储与查询

当今信息化时代充斥着大量的数据。海量数据存储是一个必然的趋势。然而数据如何的存储和查询，尤其是当今非结构化数据的快速增长，对其数据的存储，处理，查询。使得如今的关系数据库存储带来了巨大的挑战。分布存储技术是云计算的基础,主要研究如何存储、组织和管理数据中心上的大规模海量数据.由于面临的数据规模和用户规模更加庞大,在可扩展性、容错性以及成本控制方面面临着更加严峻的挑战[1]。 ...

分类：其他好文时间：2014-05-15 18:13:55 阅读次数：438

Hadoop-2.2.0中文文档—— MapReduce下一代- 可插入的 Shuffle 和 Sort

简介可插入的 shuffle 和 sort 功能，允许在shuffle 和 sort 逻辑中用可选择的实现类替换。这个情况的例子是：用一个不是HTTP的应用协议，如RDMA来 shuffle 从Map节点中到Reducer节点的数据；或者用自定义的允许 Hash聚合和Limit-N查询的算法来代替sort逻辑。重要: 可插入的 shuffle sort 功能是实验性的、不稳定。这意味着提...

分类：其他好文时间：2014-05-15 13:25:05 阅读次数：233

sqoop 1.4.3安装配置

sqoop1.4.3安装配置：1.解压tar包tar–zxvfsqoop-1.4.3.tar2.更改环境变量vi/etc/profile#添加下面两条记录 export$SQOOP_HOME=/opt/sqoop-1.4.3 PATH=$PATH:$SQOOP_HOME/bin3.复制sqoop-1.4.jarmysql-connector-java-5.1.10.jar到$HADOOP_HOME/lib/复制mysql-connector-java-..

分类：其他好文时间：2014-05-15 08:50:40 阅读次数：342

Hadoop MapReduce链式实践--ChainReducer

版本：CDH5.0.0，HDFS：2.3.0，Mapreduce:2.3.0,Yarn:2.3.0。场景描述：求一组数据中按照不同类别的最大值，比如，如下的数据：data1:A,10 A,11 A,12 A,13 B,21 B,31 B,41 B,51data2:A,20 A,21 A,22 A,23 B,201 B,301 B,401 B,501最后输出为：A,23 B,501假如这样的逻辑的m...

分类：其他好文时间：2014-05-15 08:15:04 阅读次数：374

hadoop学习；自定义Input/OutputFormat；类引用mapreduce.mapper；三种模式

hadoop分割与读取输入文件的方式被定义在InputFormat接口的一个实现中，TextInputFormat是默认的实现，当你想要一次获取一行内容作为输入数据时又没有确定的键，从TextInputFormat返回的键为每行的字节偏移量，但目前没看到用过以前在mapper中曾使用LongWritable（键）和Text（值），在TextInputFormat中，因为键是字节偏移量，可以是L...

分类：移动开发时间：2014-05-15 01:31:37 阅读次数：454

MapReduce编程实战之“高级特性”

本篇介绍MapReduce的一些高级特性，如计数器、数据集的排序和连接。计数器是一种收集作业统计信息的有效手段，排序是MapReduce的核心技术，MapReduce也能够执行大型数据集间的“”连接（join）操作。...

分类：其他好文时间：2014-05-14 23:53:44 阅读次数：553

hadoop-mapreduce中reducetask运行分析

ReduceTask的运行 Reduce处理程序中需要执行三个类型的处理， 1.copy,从各map中copy数据过来 2.sort,对数据进行排序操作。 3.reduce,执行业务逻辑的处理。 ReduceTask的运行也是通过run方法开始，通过mapreduce.job.reduce.shuffle.consumer.plugin.class配置shuffle的plugin, ...

分类：其他好文时间：2014-05-14 20:23:57 阅读次数：519

大数据时代的万象变化

近来多次和百度、阿里、腾讯、中移动数据中心的架构师进行交流，同时也在网上的论坛/社区主导大数据分析范例的一些讨论，与互联网/云开发人员进行沟通。由此，我愉快地发现，大数据分析在中国非常普遍：不光是星巴克、纸牌屋等美国文化元素在中国广受追捧；Hadoop也受到广泛接纳，并且在中国的云开发人员的讨论中占据了主导地位。...

分类：其他好文时间：2014-05-14 19:37:49 阅读次数：255

共13969条上一页 1 ... 1379 1380 1381 1382 1383 ... 1397 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)