zoukankan      html  css  js  c++  java
  • 【转】Hive内部表、外部表

    hive内部表、外部表区别自不用说,可实际用的时候还是要小心。

    1. 内部表:

    1. create table tt (name string , age string) location '/input/table_data';  


    此时,会在hdfs上新建一个tt表的数据存放地,例如,笔者是在 hdfs://master/input/table_data 

    上传hdfs数据到表中:

    1. load data inpath '/input/data' into table tt;  


    此时会将hdfs上的/input/data目录下的数据转移到/input/table_data目录下。

    删除tt表后,会将tt表的数据和元数据信息全部删除,即最后/input/table_data下无数据,当然/input/data下再上一步已经没有了数据!

    如果创建内部表时没有指定location,就会在/user/hive/warehouse/下新建一个表目录,其余情况同上。

    注意的地方就是:load data会转移数据!

    2. 外部表:

    1. create external table et (name string , age string);  


    此时,会在/user/hive/warehouse/新建一个表目录et

    1. load data inpath '/input/edata' into table et;  

    此时会把hdfs上/input/edata/下的数据转到/user/hive/warehouse/et下,删除这个外部表后,/user/hive/warehouse/et下的数据不会删除,但是/input/edata/下的数据在上一步load后已经没有了!数据的位置发生了变化!本质是load一个hdfs上的数据时会转移数据!

    3. 其他:

    (1)加上location用法一样,只不过表目录的位置不同而已。

    (2)加上partition用法也一样,只不过表目录下会有分区目录而已。

    (3)load data local inpath直接把本地文件系统的数据上传到hdfs上,有location上传到location指定的位置上,没有的话上传到hive默认配置的数据仓库中。

  • 相关阅读:
    ADB常用命令
    Java内部开发框架
    Android开发的十个建议
    通过浏览器访问网站的过程
    CDN的概念和解决的问题
    nginx实现range请求
    Nginx如何重新编译添加模块
    MP4文件在线播放首屏慢的问题
    Ubuntu下添加程序到应用程序
    一致性hash
  • 原文地址:https://www.cnblogs.com/zhengrunjian/p/4645529.html
Copyright © 2011-2022 走看看