数据仓库服务 GAUSSDB(DWS)-华为云

数据仓库服务 GAUSSDB(DWS)-CREATE TABLE:示例

示例创建简单的HStore表: CREATE TABLE warehouse_t1 ( W_WAREHOUSE_SK INTEGER NOT NULL, W_WAREHOUSE_ID CHAR(16) NOT NULL, W_WAREHOUSE_NAME VARCHAR(20) , W_WAREHOUSE_SQ_FT INTEGER , W_STREET_NUMBER CHAR(10) , W_STREET_NAME VARCHAR(60) , W_STREET_TYPE CHAR(15) , W_SUITE_NUMBER CHAR(10) , W_CITY VARCHAR(60) , W_COUNTY VARCHAR(30) , W_STATE CHAR(2) , W_ZIP CHAR(10) , W_COUNTRY VARCHAR(20) , W_GMT_OFFSET DECIMAL(5,2) )WITH(ORIENTATION=COLUMN, ENABLE_HSTORE=ON); CREATE TABLE warehouse_t2 (LIKE warehouse_t1 INCLUDING ALL);

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-CREATE TABLE:列存表的Delta表差异

列存表的Delta表差异表1 HStore表与列存表的辅助Delta表差异数仓类型列存的delta表 HStore的delta表表结构与列存主表的表定义一致与主表表定义不一样。功能用于暂存小批量insert的数据，满阈值后再merge到主表，避免直接insert到主表产生大量小CU。用于持久化存储update/delete/insert信息。在故障拉起后用于恢复内存更新链等管理并发更新的内存结构。缺陷来不及merge导致delta表膨胀，影响查询性能，同时无法解决并发update的锁冲突问题依赖后台常驻autovacuum来做merge操作。

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-CREATE TABLE:参数说明

参数说明 IF NOT EXISTS 指定IF NOT EXISTS时，若不存在同名表，则可以成功创建表。若已存在同名表，创建时不会报错，仅会提示该表已存在并跳过创建。 table_name 要创建的表名。表名长度不超过63个字符，以字母或下划线开头，可包含字母、数字、下划线、$、#。 column_name 新表中要创建的字段名。字段名长度不超过63个字符，以字母或下划线开头，可包含字母、数字、下划线、$、#。 data_type 字段的数据类型。 LIKE source_table [ like_option ... ] LIKE子句声明一个表，新表自动从这个表中继承所有字段名及其数据类型。新表与原表之间在创建动作完毕之后是完全无关的。在原表做的任何修改都不会传播到新表中，并且也不可能在扫描原表的时候包含新表的数据。被复制的列并不使用相同的名字进行融合。如果明确的指定了相同的名字或者在另外一个LIKE子句中，将会报错。 HStore表只能从HStore表中进行继承。 WITH ( { storage_parameter = value } [, ... ] ) 这个子句为表指定一个可选的存储参数。 ORIENTATION 指定表数据的存储方式，即时序方式、行存方式、列存方式，该参数设置成功后就不再支持修改。对于HStore表，应当使用列存方式，同时设置enable_hstore为on。取值范围： TIMESERIES，表示表的数据将以时序方式存储。 COLUMN，表示表的数据将以列存方式存储。 ROW，表示表的数据将以行方式存储。默认值：ROW。 COMPRESSION 指定表数据的压缩级别，它决定了表数据的压缩比以及压缩时间。一般来讲，压缩级别越高，压缩比越大，压缩时间也越长；反之亦然。实际压缩比取决于加载的表数据的分布特征。取值范围： HStore表和列存表的有效值为YES/NO和/LOW/MIDDLE/HIGH，默认值为LOW。行存表的有效值为YES/NO，默认值为NO。 COMPRESSLEVEL 指定表数据同一压缩级别下的不同压缩水平，它决定了同一压缩级别下表数据的压缩比以及压缩时间。对同一压缩级别进行了更加详细的划分，为用户选择压缩比和压缩时间提供了更多的空间。总体来讲，此值越大，表示同一压缩级别下压缩比越大，压缩时间越长；反之亦然。该参数只对时序表和列存表有效。取值范围：0~3 默认值：0 MAX_BATCHROW 指定了在数据加载过程中一个存储单元可以容纳记录的最大数目。该参数只对时序表和列存表有效。取值范围：10000~60000 默认值：60000 PARTIAL_CLUSTER_ROWS 指定了在数据加载过程中进行将局部聚簇存储的记录数目。该参数只对时序表和列存表有效。取值范围：600000~2147483647 enable_delta 指定了在列存表是否开启delta表。对HStore表不能开启该参数。默认值：off enable_hstore 指定了是否创建为H-Store表（基于列存表实现）。该参数只对列存表有效。该参数仅8.2.0.100及以上集群版本支持。云原生3.0暂不支持该参数。默认值：off 打开该参数时必须设置以下GUC参数用于保证H-Store表的清理，推荐值如下： autovacuum=true，autovacuum_max_workers=6，autovacuum_max_workers_hstore=3。 SUB_PARTITION_COUNT 指定二级分区的个数。该参数用于设置在导入阶段二级分区个数。在建表时进行设置，建表后不支持修改。不建议用户随意设置该默认值，可能会影响导入和查询的性能。取值范围：1～1024 默认值：32 DELTAROW_THRESHOLD 指定HStore表导入时小于多少行(SUB_PARTITION_COUNT * DELTAROW_THRESHOLD)的数据进入delta表。取值范围：0～60000 默认值：60000 COLVERSION 指定存储格式的版本。 HStore表只支持2.0版本。取值范围： 1.0：列存表的每列以一个单独的文件进行存储，文件名以relfilenode.C1.0、relfilenode.C2.0、relfilenode.C3.0等命名。 2.0：列存表的每列合并存储在一个文件中，文件名以relfilenode.C1.0命名。默认值：2.0 DISTRIBUTE BY 指定表如何在节点之间分布或者复制。取值范围： HASH (column_name ) ：对指定的列进行Hash，通过映射，把数据分布到指定DN。 TO { GROUP groupname | NODE ( nodename [, ... ] ) } TO GROUP指定创建表所在的Node Group，目前不支持hdfs表使用。TO NODE主要供内部扩容工具使用，一般用户不应该使用。 PARTITION BY 指定HStore表的初始分区。

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-CREATE TABLE:语法格式

语法格式 1 2 3 4 5 6 7 8 9 10 11 12 13 14 CREATE TABLE [ IF NOT EXISTS ] table_name ({ column_name data_type | LIKE source_table [like_option [...] ] } } [, ... ]) [ WITH ( {storage_parameter = value} [, ... ] ) ] [ TABLESPACE tablespace_name ] [ DISTRIBUTE BY HASH ( column_name [,...])] [ TO { GROUP groupname | NODE ( nodename [, ... ] ) } ] [ PARTITION BY { {RANGE (partition_key) ( partition_less_than_item [, ... ] )} } [ { ENABLE | DISABLE } ROW MOVEMENT ] ]; 其中like选项like_option为： { INCLUDING | EXCLUDING } { DEFAULTS | CONSTRAINTS | INDEXES | STORAGE | COMMENTS | PARTITION | RELOPTIONS | DISTRIBUTION | ALL }

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-CREATE TABLE:注意事项

注意事项创建HStore表的用户需要拥有schema cstore的USAGE权限。表级参数enable_delta与enable_hstore无法同时开启，因为enable_delta用于控制普通列存表的delta开启，会与enable_hstore冲突。每一个HStore表绑定一张delta表，delta表的oid记录在pg_class中reldeltaidx字段（reldelta字段被列存表的delta表使用）。

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-实时数仓GUC参数:autovacuum_max_workers_hstore

autovacuum_max_workers_hstore 参数说明：设置Autovacuum_max_workers里面，能同时运行的专用于清理hstore的自动清理线程的最大数量。参数类型：SIGHUP 取值范围：整型默认值：0 当需要使用hstore表时，一定要同步修改以下参数的默认值，否则会导致hstore表性能严重劣化，推荐的修改配置是： autovacuum_max_workers_hstore=3，autovacuum_max_workers=6，autovacuum=true。

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-实时数仓GUC参数:autovacuum_max_workers

autovacuum_max_workers 参数说明：设置能同时运行的自动清理线程的最大数量，该参数的取值上限与max_connections和job_queue_processes大小有关。参数类型：SIGHUP 取值范围：整型最小值为0，表示不会自动进行autovacuum。理论最大值为262143，实际最大值为动态值。计算公式为“262143 - max_inner_tool_connections - max_connections - job_queue_processes - 辅助线程数 – autovacuum的launcher线程数 - 1”，其中辅助线程数和autovacuum的launcher线程数由两个宏来指定，当前版本的默认值分别为20和2。默认值：3

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-MERGE INTO:示例

示例创建进行MERGE INTO的目标： 1 2 CREATE TABLE target(a int, b int)WITH(ORIENTATION = COLUMN, ENABLE_HSTORE = ON); INSERT INTO target VALUES(1, 1),(2, 2); 创建数据源表： 1 2 CREATE TABLE source(a int, b int)WITH(ORIENTATION = COLUMN, ENABLE_HSTORE = ON); INSERT INTO source VALUES(1, 1),(2, 2),(3, 3),(4, 4),(5, 5); 执行MERGE INTO操作： 1 2 3 4 5 6 7 MERGE INTO target t USING source s ON (t.a = s.a) WHEN MATCHED THEN UPDATE SET t.b = t.b + 1 WHEN NOT MATCHED THEN INSERT VALUES (s.a, s.b) WHERE s.b % 2 = 0;

数据仓库服务 GAUSSDB(DWS) 实时数仓语法

数据仓库服务 GAUSSDB(DWS)-MERGE INTO:语法格式

语法格式 1 2 3 4 5 6 7 8 9 10 11 12 13 14 MERGE INTO table_name [ [ AS ] alias ] USING { { table_name | view_name } | subquery } [ [ AS ] alias ] ON ( condition ) [ WHEN MATCHED THEN UPDATE SET { column_name = { expression | DEFAULT } | ( column_name [, ...] ) = ( { expression | DEFAULT } [, ...] ) } [, ...] [ WHERE condition ] ] [ WHEN NOT MATCHED THEN INSERT { DEFAULT VALUES | [ ( column_name [, ...] ) ] VALUES ( { expression | DEFAULT } [, ...] ) [, ...] [ WHERE condition ] } ];

数据仓库服务 GAUSSDB(DWS) 实时数仓语法

数据仓库服务 GAUSSDB(DWS)-MERGE INTO:参数说明

参数说明 INTO子句指定正在更新或插入的目标表。 table_name 目标表的表名。 alias 目标表的别名。取值范围：字符串，符合标识符命名规范。 USING子句指定源表，源表可以为表、视图或子查询。 ON子句关联条件，用于指定目标表和源表的关联条件。不支持更新关联条件中的字段。ON关联条件可以是ctid, xc_node_id, tableoid这三个系统列。 WHEN MATCHED子句当源表和目标表中数据针对关联条件可以匹配上时，选择WHEN MATCHED子句进行UPDATE操作。不支持更新分布列、系统表以及系统列。 WHEN NOT MATCHED子句当源表和目标表中数据针对关联条件无法匹配时，选择WHEN NOT MATCHED子句进行INSERT操作。不支持INSERT子句中包含多个VALUES。 WHEN MATCHED和WHEN NOT MATCHED子句顺序可以交换，可以缺省其中一个，但不能同时缺省。不支持同时指定两个WHEN MATCHED或WHEN NOT MATCHED子句。

数据仓库服务 GAUSSDB(DWS) 实时数仓语法

数据仓库服务 GAUSSDB(DWS)-CREATE TABLE:注意事项

注意事项列存表支持的数据类型请参考列存表支持的数据类型。创建列存和HDFS分区表的数量建议不超过1000个。表中的主键约束和唯一约束必须包含分布列。如果在建表过程中数据库系统发生故障，系统恢复后可能无法自动清除之前已创建的、大小为0的磁盘文件。此种情况出现概率小，不影响数据库系统的正常运行。列存表支持PARTIAL CLUSTER KEY、主键和唯一表级约束，不支持外键表级约束。列存表的字段约束只支持NULL、NOT NULL和DEFAULT常量值。列存表支持delta表，受表级参数enable_delta控制是否开启，受参数deltarow_threshold控制进入delta表的阈值。不推荐使用列存带Delta表，否则会出现由于来不及merge而导致的磁盘膨胀以及性能劣化等问题。冷热表仅支持列存分区表，依赖于可用的OBS服务。冷热表仅支持默认表空间为default_obs_tbs，如需新增obs表空间可联系技术支持。

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-CREATE TABLE:语法格式

语法格式 1 2 3 4 5 6 7 8 9 10 11 12 CREATE [ [ GLOBAL | LOCAL | VOLATILE ] { TEMPORARY | TEMP } | UNLOGGED ] TABLE [ IF NOT EXISTS ] table_name { ({ column_name data_type [ compress_mode ] [ COLLATE collation ] [ column_constraint [ ... ] ] | table_constraint | LIKE source_table [ like_option [...] ] } [, ... ])| LIKE source_table [ like_option [...] ] } [ WITH ( {storage_parameter = value} [, ... ] ) ] [ ON COMMIT { PRESERVE ROWS | DELETE ROWS } ] [ COMPRESS | NOCOMPRESS ] [ DISTRIBUTE BY { REPLICATION | ROUNDROBIN | { HASH ( column_name [,...] ) } } ] [ TO { GROUP groupname | NODE ( nodename [, ... ] ) } ] [ COMMENT [=] 'text' ]; 其中列约束column_constraint为： 1 2 3 4 5 6 7 8 9 10 [ CONSTRAINT constraint_name ] { NOT NULL | NULL | CHECK ( expression ) | DEFAULT default_expr | ON UPDATE on_update_expr | COMMENT 'text' | UNIQUE [ NULLS [NOT] DISTINCT | NULLS IGNORE ] index_parameters | PRIMARY KEY index_parameters } [ DEFERRABLE | NOT DEFERRABLE | INITIALLY DEFERRED | INITIALLY IMMEDIATE ] 其中列的压缩可选项compress_mode为： 1 { DELTA | PREFIX | DICTIONARY | NUMSTR | NOCOMPRESS } 其中表约束table_constraint为： 1 2 3 4 5 6 [ CONSTRAINT constraint_name ] { CHECK ( expression ) | UNIQUE [ NULLS [NOT] DISTINCT | NULLS IGNORE ] ( column_name [, ... ] ) index_parameters | PRIMARY KEY ( column_name [, ... ] ) index_parameters | PARTIAL CLUSTER KEY ( column_name [, ... ] ) } [ DEFERRABLE | NOT DEFERRABLE | INITIALLY DEFERRED | INITIALLY IMMEDIATE ] 其中like选项like_option为： 1 { INCLUDING | EXCLUDING } { DEFAULTS | CONSTRAINTS | INDEXES | STORAGE | COMMENTS | PARTITION | RELOPTIONS | DISTRIBUTION | DROPCOLUMNS | ALL } 其中索引参数index_parameters为： 1 [ WITH ( {storage_parameter = value} [, ... ] ) ]

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-CREATE PUBLICATION:示例

示例创建一个发布，发布两个表和两个模式中所有更改。创建示例表tpcds.ship_mode_t1： CREATE TABLE tpcds.ship_mode_t1 ( SM_SHIP_MODE_SK INTEGER NOT NULL, SM_SHIP_MODE_ID CHAR(16) NOT NULL, SM_TYPE CHAR(30) , SM_CODE CHAR(10) , SM_CARRIER CHAR(20) , SM_CONTRACT CHAR(20) ) WITH (ORIENTATION = COLUMN,enable_disaster_cstore='on') DISTRIBUTE BY HASH(SM_SHIP_MODE_SK); 创建示例表tpcds.customer_address_p1： CREATE TABLE tpcds.customer_address_p1 ( CA_ADDRESS_SK INTEGER NOT NULL, CA_ADDRESS_ID CHAR(16) NOT NULL, CA_STREET_NUMBER CHAR(10) , CA_STREET_NAME VARCHAR(60) , CA_STREET_TYPE CHAR(15) , CA_SUITE_NUMBER CHAR(10) , CA_CITY VARCHAR(60) , CA_COUNTY VARCHAR(30) , CA_STATE CHAR(2) , CA_ZIP CHAR(10) , CA_COUNTRY VARCHAR(20) , CA_GMT_OFFSET DECIMAL(5,2) , CA_LOCATION_TYPE CHAR(20) ) WITH (ORIENTATION = COLUMN,enable_disaster_cstore='on') DISTRIBUTE BY HASH(CA_ADDRESS_SK); 创建示例模式myschema1： CREATE SCHEMA myschema1; 创建示例模式myschema2： CREATE SCHEMA myschema2; 创建发布，发布两个表和两个模式中所有更改。 CREATE PUBLICATION mypublication FOR TABLE users, departments, ALL TABLES IN SCHEMA myschema1, myschema2; 创建一个发布，发布所有表中的所有更改。 CREATE PUBLICATION alltables FOR ALL TABLES;

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-CREATE PUBLICATION:语法格式

语法格式 1 2 3 4 CREATE PUBLICATION name [ FOR ALL TABLES | FOR publication_object [, ... ] ] [ WITH ( publication_parameter [=value] [, ... ] ) ]; 其中发布对象publication_object为： TABLE table_name [, ...] | ALL TABLES IN SCHEMA schema_name [, ... ]

数据仓库服务 GAUSSDB(DWS)

数据仓库服务 GAUSSDB(DWS)-CREATE PUBLICATION:参数说明

参数说明 name 新发布的名称。取值范围：字符串，要符合标识符的命名规范。 FOR ALL TABLES 将发布标记为复制数据库中所有细粒度容灾主表的更改，包括在将来创建的表。 FOR TABLE 指定要添加到发布的表的列表。只有细粒度容灾主表才能成为发布的一部分。 table_name 要添加到发布的表的名字，可以带模式名。取值范围：字符串，要符合标识符的命名规范。 FOR ALL TABLES IN SCHEMA 将发布标记为复制指定模式列表中所有细粒度容灾主表的更改，包括在将来创建的表。 schema_name 要添加到发布的模式的名字。取值范围：字符串，要符合标识符的命名规范。 WITH ( publication_parameter [=value] [, ... ] ) 该子句指定发布的可选参数。支持下列参数： publish 这个参数决定了哪些DML操作将由新的发布发布给订阅者。取值范围：字符串，用逗号分隔的操作列表。允许的操作是insert， update，delete和truncate。默认值：insert，update，delete，truncate。即发布所有动作。

数据仓库服务 GAUSSDB(DWS)

云服务器内容精选

数据仓库服务 GAUSSDB(DWS)

7*24

备案

专业服务

退订

建议反馈

售前咨询热线