搜索关键字：hive ，搜索到5904个结果！码迷,mamicode.com！

为什么要使用Spark？

现有的hadoop生态系统中存在的问题1）使用mapreduce进行批量离线分析；2）使用hive进行历史数据的分析；3）使用hbase进行实时数据的查询；4）使用storm进行实时的流处理；5）。。。。。。导致：维护成本高、学习成本高Spark的出现弥补了Hadoop生态系统中的缺陷，使用spar...

分类：其他好文时间：2014-06-28 14:08:46 阅读次数：306

初识 Cloudera Impala

Impala是Cloudera公司主导开发的新型查询系统，它提供SQL语义，能查询存储在Hadoop的HDFS和HBase中的PB级大数据。已有的Hive系统虽然也提供了SQL语义，但由于Hive底层执行使用的是MapReduce引擎，仍然是一个批处理过程，难以满足查询的交互性。相比之下，Impala的最大特点也是最大卖点就是它的快速。Impala 为存储在 HDFS 和 HBase 中的数据提供了一个实时 SQL 查询接口。...

分类：其他好文时间：2014-06-25 10:56:38 阅读次数：355

查看hive版本

hive没有提供hive --version这种方式查看版本好，所以要找到hive所在目录，然后查看jar包的版本号，比如：# ls /usr/local/hive/lib/ antlr-2.7.7.jar datanucleus-core-2.0.3.jar hive-jdbc-0.10.0.jar jline-1.0.ja...

分类：其他好文时间：2014-06-24 23:20:21 阅读次数：377

CDH5上安装Hive,HBase,Impala,Spark等服务

Apache Hadoop的服务的部署比较繁琐，需要手工处理配置文件、下载依赖包等。Cloudera Manager以GUI的方式的管理CDH集群，提供向导式的安装步骤。由于需要对Hive,HBase,Impala,Spark进行功能测试，就采用了Cloudera Manager方式进行安装。本文讲解的是parcel安装方式。...

分类：其他好文时间：2014-06-24 22:44:17 阅读次数：501

hive的查询注意事项以及优化总结 .

一、控制Hive中Map和reduce的数量Hive中的sql查询会生成执行计划，执行计划以MapReduce的方式执行，那么结合数据和集群的大小，map和reduce的数量就会影响到sql执行的效率。除了要控制Hive生成的Job的数量，也要控制map和reduce的数量。1、map的数量，通常情...

分类：其他好文时间：2014-06-23 07:48:43 阅读次数：288

使用sqoop从mysql往hive中增量导数据shell脚本

一：sqoop增量导入的两种方式Incremental import arguments:ArgumentDescription--check-column (col)Specifies the column to be examined when determining which rows to...

分类：数据库时间：2014-06-23 00:58:09 阅读次数：345

Hadoop Hive sql 语法详解

Hive 是基于Hadoop 构建的一套数据仓库分析系统，它提供了丰富的SQL查询方式来分析存储在Hadoop 分布式文件系统中的数据，可以将结构化的数据文件映射为一张数据库表，并提供完整的SQL查询功能，可以将SQL语句转换为MapReduce任务进行运行，通过自己的SQL 去查询分析需要的内容，这套SQL 简称Hive SQL，使不熟悉mapreduce 的用户很方便的利用SQL 语言...

分类：数据库时间：2014-06-22 22:41:52 阅读次数：342

Hive 进阶

Hive 桶分区 map array struct...

分类：其他好文时间：2014-06-22 21:57:10 阅读次数：184

详细图解快速入门kettle

写在前面一：数据仓库ETL工具有很多，基于大数据环境下的分析，Hive用的多些。本文介绍国外的一款开源ETL工具——Kettle。写在前面二：所用软件说明：一、什么是Kettle Kettle是一款国外开源的ETL工具，纯java编写，绿色无需安装，数据抽取高效稳定(数据迁移工具)。Kettle中有两种脚本文件，transformation和job，transf...

分类：其他好文时间：2014-06-22 12:01:20 阅读次数：619

hive 学习之异常篇

一、刚装上hive在执行hive启动的过程中出现[hadoop@localhost hive-0.6.0]$ hiveInvalid maximum heap size: -Xmx4096mThe specified size exceeds the maximum representable si...

分类：其他好文时间：2014-06-20 22:17:04 阅读次数：278

共5904条上一页 1 ... 581 582 583 584 585 ... 591 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)