华为云首页用户手册

MAPREDUCE服务 MRS-建立Hive表分区提升查询效率:操作步骤

MAPREDUCE服务 MRS-建立Hive表分区提升查询效率:操作步骤

时间：2024-11-28 01:44:13

MAPREDUCE服务 MRS Hive性能调优

操作步骤

以root用户登录已安装Hive客户端的节点。
执行以下命令，进入客户端安装目录，例如“/opt/client”。

cd /opt/client
执行source bigdata_env命令，配置客户端环境变量。
在客户端中执行如下命令，执行登录操作。

kinit 用户名
执行以下命令登录Hive客户端。

beeline
指定静态分区或者动态分区。
- 静态分区：
  静态分区是手动输入分区名称，在创建表时使用关键字PARTITIONED BY指定分区列名及数据类型。应用开发时，使用ALTER TABLE ADD PARTITION语句增加分区，以及使用LOAD DATA INTO PARTITON语句将数据加载到分区时，只能加载到静态分区。
- 动态分区：通过查询命令，将结果插入到某个表的分区时，可以使用动态分区。
  动态分区通过在客户端工具执行如下命令开启：
  
  set hive.exec.dynamic.partition=true;
  
  动态分区默认模式是“strict”，也就是必须至少指定一列为静态分区，在静态分区下建立动态子分区，可以通过如下设置开启完全的动态分区：
  
  set hive.exec.dynamic.partition.mode=nonstrict;
- 动态分区可能导致一个DML语句创建大量的分区，对应创建大量新文件夹，对系统性能可能带来影响。
- 在文件数量大的情况下，执行一个SQL语句启动时间较长，可以在执行SQL语句之前执行“set mapreduce.input.fileinputformat.list-status.num-threads = 100;”命令缩短启动时间。“mapreduce.input.fileinputformat.list-status.num-threads”参数需要先添加到Hive的白名单才可设置。

上一篇：MAPREDUCE服务 MRS-Hive Join数据优化:Sort Merge Bucket Map Join

下一篇：MAPREDUCE服务 MRS-Hive日志介绍:日志级别

新客秒杀 2核2G 3M L实例

68元/年

普惠上云领千元上云礼券

立即前往

企业专享 X实例 4核8G 5M

888元/年

热门域名 1元随心购

1元/年起

MAPREDUCE服务 MRS-建立Hive表分区提升查询效率:操作步骤

意见反馈

0/200

提交成功！非常感谢您的反馈，我们会继续努力做到更好反馈提交失败！请稍后重试！

推荐文章

解决方案
相关专题