Hive内部表和外部表的区别详解

Hive内部表和外部表的区别详解 – CSDN博客

1.内部表

create tabletest (name string , age string) location ‘/input/table_data’;

注:hive默认创建的是内部表

此时,会在hdfs上新建一个test表的数据存放地

loaddata inpath ‘/input/data’ into table test ;

2. 外部表

create external tableetest (name string , age string);

会在/user/hive/warehouse/新建一个表目录et

loaddata inpath ‘/input/edata’ into tableetest;

把hdfs上/input/edata/下的数据转到/user/hive/warehouse/et下,删除这个外部表后,/user/hive/warehouse/et下的数据不会删除,但是/input/edata/下的数据在上一步load后已经没有了!数据的位置发生了变化!

本质是load一个hdfs上的数据时会转移数据!

内部表&外部表

未被external修饰的是内部表(managed table),被external修饰的为外部表(external table); 

区别: 

内部表数据由Hive自身管理,外部表数据由HDFS管理; 

内部表数据存储的位置是hive.metastore.warehouse.dir(默认:/user/hive/warehouse),外部表数据的存储位置由自己制定; 

删除内部表会直接删除元数据(metadata)及存储数据;删除外部表仅仅会删除元数据,HDFS上的文件并不会被删除; 

对内部表的修改会将修改直接同步给元数据,而对外部表的表结构和分区进行修改,则需要修复(MSCK REPAIR TABLE table_name;)

    原文作者:任嘉平生愿
    原文地址: https://www.jianshu.com/p/387a3a79c378
    本文转自网络文章,转载此文章仅为分享知识,如有侵权,请联系博主进行删除。
点赞