码迷,mamicode.com
首页 > 其他好文 > 详细

【转】Hive内部表、外部表

时间:2015-07-14 17:21:38      阅读:149      评论:0      收藏:0      [点我收藏+]

标签:

hive内部表、外部表区别自不用说,可实际用的时候还是要小心。

1. 内部表:

 

  1. create table tt (name string , age string) location ‘/input/table_data‘;  


此时,会在hdfs上新建一个tt表的数据存放地,例如,笔者是在 hdfs://master/input/table_data 

 

上传hdfs数据到表中:

 

  1. load data inpath ‘/input/data‘ into table tt;  


此时会将hdfs上的/input/data目录下的数据转移到/input/table_data目录下。

 

删除tt表后,会将tt表的数据和元数据信息全部删除,即最后/input/table_data下无数据,当然/input/data下再上一步已经没有了数据!

如果创建内部表时没有指定location,就会在/user/hive/warehouse/下新建一个表目录,其余情况同上。

注意的地方就是:load data会转移数据!

2. 外部表:

 

  1. create external table et (name string , age string);  


此时,会在/user/hive/warehouse/新建一个表目录et

 

 

  1. load data inpath ‘/input/edata‘ into table et;  

 

此时会把hdfs上/input/edata/下的数据转到/user/hive/warehouse/et下,删除这个外部表后,/user/hive/warehouse/et下的数据不会删除,但是/input/edata/下的数据在上一步load后已经没有了!数据的位置发生了变化!本质是load一个hdfs上的数据时会转移数据!

3. 其他:

 

(1)加上location用法一样,只不过表目录的位置不同而已。

(2)加上partition用法也一样,只不过表目录下会有分区目录而已。

(3)load data local inpath直接把本地文件系统的数据上传到hdfs上,有location上传到location指定的位置上,没有的话上传到hive默认配置的数据仓库中。

【转】Hive内部表、外部表

标签:

原文地址:http://www.cnblogs.com/zhengrunjian/p/4645529.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!