Hive 建表语句

本文详细介绍了Hive的建表语句,包括CREATE TABLE、EXTERNAL、COMMENT、PARTITIONED BY、CLUSTERED BY等关键语法。同时,讨论了ROW FORMAT、FIELDS TERMINATED BY、STORED AS等选项,用于自定义数据序列化和存储格式。通过这些语句,可以创建内部表、外部表,并进行分区、分桶和排序,以优化数据管理和查询效率。

Hive 建表语句

CREATE [EXTERNAL] TABLE [IF NOT EXISTS] table_name 
[(col_name data_type [COMMENT col_comment], ...)] 
[COMMENT table_comment] 
[PARTITIONED BY (col_name data_type [COMMENT col_comment], ...)] 
[CLUSTERED BY (col_name, col_name, ...) 
[SORTED BY (col_name [ASC|DESC], ...)] INTO num_buckets BUCKETS] 
[ROW FORMAT row_format] 
[STORED AS file_format] 
[LOCATION hdfs_path]

 

字段解释说明

  1. CREATE TABLE 创建指定名称的表,如果存在报异常,可以使用 IF NOT EXISTS 来避免这个异常。
  2. EXTERNAL 创建外部表,在建表的同时可以指定源数据的路径(LOCATION),创建内部表时,会将数据移动到数据仓库指向的路径,若创建外部表不会有任何改变。在删除表时,内部表的元数据和源数据都会被删除,外部表不会删除源数据。
  3. COMMENT 为表和列增加注释
  4. PARTITIONED BY 创建分区表
  5. CLUSTERED BY 创建分桶表
  6. SORTED BY  创建排序后分桶表(不常用)
  7. ROW FORMAT DELIMITED  建表的时候可以自定义SerDe或者使用自带的SerDe。如果没有指定 ROW FORMAT 或者 ROW FORMAT DELIMITED,将会使用自带的SerDe。 SerDe是 Serialize/Deserilize的简称,用于序列化和反序列化。
    1. [FIELDS TERMINATED BY char] 
    2. [COLLECTION ITEMS TERMINATED BY char]
    3. [MAP KEYS TERMINATED BY char]
    4. [LINES TERMINATED BY char] | SERDE serde_name [WITH SERDEPROPERTIES (property_name=property_value, property_name=property_value, ...)]
  8. STORED AS 指定存储文件类型  sequencefile (二进制序列文件)、textfile(文本)、rcfile(列式存储格式文件)
  9. LOCATION 指定表在 hdfs 上的存储位置
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值