云数据库 GAUSSDB-案例:选择合适的分布列:优化分析

时间:2024-11-02 18:49:42

优化分析

如果将a作为t1和t2的分布列:

1
2
CREATE TABLE t1 (a int, b int) DISTRIBUTE BY HASH (a);
CREATE TABLE t2 (a int, b int) DISTRIBUTE BY HASH (a);

则执行计划将存在“Streaming”,导致DN之间存在较大通信数据量,如图1所示。

图1 选择合适的分布列案例(一)

如果将a作为t1的分布列,将b作为t2的分布列:

1
2
CREATE TABLE t1 (a int, b int) DISTRIBUTE BY HASH (a);
CREATE TABLE t2 (a int, b int) DISTRIBUTE BY HASH (b);

则执行计划将不包含“Streaming”,减少DN之间存在的通信数据量,从而提升查询性能,如图2所示。

图2 选择合适的分布列案例(二)
support.huaweicloud.com/distributed-devg-v8-gaussdb/gaussdb-12-0302.html