sqoop导入mysql数据到hive外部表之动态分区表

793 篇文章 ¥99.90 ¥299.90
本文介绍了如何将mysql的数据通过sqoop导入到hive的外部表,并根据某个字段创建动态分区。首先创建hive外部表,然后使用sqoop导入数据至临时表,接着将临时表数据按需动态分区插入目标表,最后删除临时表。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

目的:hive外部表使用mysql的某个字段作为分区字段或者某个字段的处理后的值作为分区字段.

思路:

    先sqoop 导入到hive临时表,然后再导入到hive分区表

1 建hive外部表

CREATE external TABLE `ceshi.ods_asset` (

`ID` bigint,

`CLIENT_ID` bigint COMMENT '客户id',

`CLIENT_NUMBER` int COMMENT '客户编号',

`DELIVERY_NUMBER` string COMMENT '发货号'

) comment '产品销售表'

partitioned by (delivery_date int comment '发货日期')

stored as parquet

location '/warehouse/ppn2/ods/ods_asset'

tblproperties("parquet.compression"="snappy");

2 导入mysql到hive临时表

sqoop import \

--connect jdbc:mysql://192.168.100.11:3306/ceshidb?characterEncoding=utf-8 \

--username aaa\

--password bbb\

--delete-target-dir \

--table asset \

### 使用 SqoopMySQL 数据导入 Hive #### 准备工作 为了成功执行此操作,需确保已安装并配置好 Hadoop、HiveSqoop 环境。还需确认 MySQL JDBC 驱动程序位于 `$SQOOP_HOME/lib` 目录下。 #### 基本命令结构 基本的 Sqoop 导入命令如下所示: ```bash sqoop import \ --connect jdbc:mysql://<hostname>:<port>/<database> \ --username <user_name> \ --password <password> \ --table <source_table> \ --hive-import \ --hive-table <target_hive_db>.<target_hive_table> ``` 上述命令用于连接至指定数据库并将选定格的数据迁移到 Hive 中[^1]。 #### 动态分区加载实例 对于带有动态分区功能的情况,则可以采用下面这种方式来实现数据迁移过程中的自动分区创建与填充: ```bash sqoop import \ -Dmapreduce.job.queuename=<queue_name> \ --connect jdbc:mysql://<hostname>:<port>/<database> \ --username <user_name> \ --password <password> \ --query "SELECT * FROM work.work_data WHERE \$CONDITIONS AND day >= '2023-01-01' AND day <= '2023-01-31'" \ --hive-import \ --create-hive-table \ --hive-table ods.work_data \ --hive-partition-key day \ --hive-partition-value '${day}' \ -m 1 ``` 这段脚本会从 `work.work_data` 中提取特定日期范围内的记录,并按照 `day` 列来进行分区处理,在目标 Hive 库内建立相应的外部表结构[^2]。 #### 注意事项 当涉及到大量数据传输时,建议适当调整任务并发度 (`-m`) 参数以及优化查询条件以提高效率;另外需要注意的是源端 SQL 查询语句里必须包含 `${CONDITIONS}` 占位符以便于触发器正常运作[^3]。
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

Thomas2143

您的打赏是我的动力!!!

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值