↑↓ 选择↵ 打开⌫ 切换范围完整搜索

PG.CENTER 连接 PostgreSQL 文档、百科与生态知识。由 Pigsty 维护。

支持中的版本: 当前版本 (18) / 17 / 16 / 15
开发中的版本: 19 / 20devel

MERGE

MERGE — 有条件地插入、更新或删除表中的行

大纲

[ WITH with_query [, ...] ]
MERGE INTO [ ONLY ] target_table_name [ * ] [ [ AS ] target_alias ]
    USING data_source ON join_condition
    when_clause [...]
    [ RETURNING { * | output_expression [ [ AS ] output_name ] } [, ...] ]

其中 data_source 为:

    { [ ONLY ] source_table_name [ * ] | ( source_query ) } [ [ AS ] source_alias ]

而 when_clause 为:

    { WHEN MATCHED [ AND condition ] THEN { merge_update | merge_delete | DO NOTHING } |
      WHEN NOT MATCHED BY SOURCE [ AND condition ] THEN { merge_update | merge_delete | DO NOTHING } |
      WHEN NOT MATCHED [ BY TARGET ] [ AND condition ] THEN { merge_insert | DO NOTHING } }

而 merge_insert 为:

    INSERT [( column_name [, ...] )]
        [ OVERRIDING { SYSTEM | USER } VALUE ]
        { VALUES ( { expression | DEFAULT } [, ...] ) | DEFAULT VALUES }

而 merge_update 为:

    UPDATE SET { column_name = { expression | DEFAULT } |
                 ( column_name [, ...] ) = [ ROW ] ( { expression | DEFAULT } [, ...] ) |
                 ( column_name [, ...] ) = ( sub-SELECT )
               } [, ...]

而 merge_delete 为:

    DELETE

描述

MERGE 使用 data_source 对由 target_table_name 标识的目标表中的行执行修改动作。MERGE 提供了一条单独的 SQL 语句,可按条件对行执行 INSERT、UPDATE 或 DELETE;否则,这项工作需要多条过程语言语句。

首先,MERGE 命令会将 data_source 与目标表执行连接,生成零个或多个候选变更行。对于每个候选变更行,系统只会确定一次其状态是 MATCHED、NOT MATCHED BY SOURCE 还是 NOT MATCHED [BY TARGET],然后按指定顺序对 WHEN 子句求值。对于每个候选变更行,只执行第一个求值为真的子句。任何候选变更行都不会执行多个 WHEN 子句。

MERGE 中的各个动作,与常规的 UPDATE、INSERT 或 DELETE 同名命令具有相同效果。不过这些动作的语法有所不同,尤其是没有 WHERE 子句,也不指定表名。所有动作都针对目标表,不过也可以借助触发器修改其他表。

当指定 DO NOTHING 时,源行会被跳过。由于动作会按其指定顺序求值,DO NOTHING 有助于在进行更细粒度处理之前跳过不需要关注的源行。

可选的 RETURNING 子句会让 MERGE 针对每个被插入、更新或删除的行计算并返回值。可以计算任何使用源表或目标表列的表达式,也可以调用 merge_action() 函数。执行 INSERT 或 UPDATE 动作时,使用目标表各列的新值;执行 DELETE 动作时,使用目标表各列的旧值。RETURNING 列表的语法与 SELECT 的输出列表完全相同。

没有单独的 MERGE 权限。如果指定更新动作,则必须对目标表中 SET 子句所引用的列具有 UPDATE 权限。如果指定插入动作,则必须对目标表具有 INSERT 权限。如果指定删除动作,则必须对目标表具有 DELETE 权限。如果指定 DO NOTHING 动作,则必须对目标表中至少一列具有 SELECT 权限。对于 data_source 以及目标表中在任何 condition(包括 join_condition)或 expression 中引用的列,你还必须具有 SELECT 权限。权限只会在语句开始时测试一次,而且无论特定的 WHEN 子句是否执行,都会进行检查。

如果目标表是物化视图、外部表,或者其上定义了任何规则,则不支持 MERGE。

参数

with_query #

WITH 子句允许你指定一个或多个子查询,以便在 MERGE 查询中按名称引用它们。有关细节请参见第 7.8 节和 SELECT。请注意,MERGE 不支持 WITH RECURSIVE。

target_table_name #

要合并到其中的目标表或视图名称(可选模式限定)。如果在表名前指定 ONLY,则匹配行只会在该命名表中被更新或删除。如果未指定 ONLY,则匹配行还会在继承自该命名表的任何表中被更新或删除。也可以在表名后指定*,以显式表明包含后代表。ONLY 关键字和* 选项不会影响插入动作,因为插入动作始终只会插入到该命名表中。

如果 target_table_name 是一个视图,它必须要么是没有 INSTEAD OF 触发器的自动可更新视图,要么为 WHEN 子句中指定的每一种动作类型(INSERT、UPDATE 和 DELETE)都定义了 INSTEAD OF 触发器。不支持带有规则的视图。

target_alias #

目标表的替代名称。提供别名后,它会完全隐藏表的实际名称。例如,给定 MERGE INTO foo AS f,则 MERGE 语句的其余部分必须将该表称为 f,而不是 foo。

source_table_name #

源表、视图或过渡表的名称(可选模式限定)。如果在表名前指定 ONLY,则只包含来自该命名表的匹配行。如果未指定 ONLY,则还会包含来自继承自该命名表的任何表的匹配行。也可以在表名后指定*,以显式表明包含后代表。

source_query #

一个查询(SELECT 语句或 VALUES 语句),用于提供要合并到目标表中的行。其语法说明请参见 SELECT 语句或 VALUES 语句。

source_alias #

数据源的替代名称。提供别名后,它会完全隐藏表的实际名称,或者隐藏此处实际使用的是一个查询这一事实。

join_condition #

join_condition 是一个返回 boolean 类型值的表达式(类似于 WHERE 子句),用于指定 data_source 中的哪些行与目标表中的行匹配。

警告

只有那些用于尝试将 data_source 行与目标表行匹配的目标表列,才应出现在 join_condition 中。只引用目标表列的 join_condition 子表达式可能影响所采取的动作,而且常常会令人意外。

如果同时指定了 WHEN NOT MATCHED BY SOURCE 和 WHEN NOT MATCHED [BY TARGET] 子句,MERGE 命令将对 data_source 与目标表执行 FULL 连接。要做到这一点,至少有一个 join_condition 子表达式必须使用可支持哈希连接的操作符,或者所有子表达式都必须使用可支持归并连接的操作符。

when_clause #

至少需要一个 WHEN 子句。

WHEN 子句可以指定 WHEN MATCHED、WHEN NOT MATCHED BY SOURCE 或 WHEN NOT MATCHED [BY TARGET]。请注意,SQL 标准只定义了 WHEN MATCHED 和 WHEN NOT MATCHED(后者定义为没有匹配的目标行)。WHEN NOT MATCHED BY SOURCE 是对 SQL 标准的扩展,而给 WHEN NOT MATCHED 追加 BY TARGET 选项也是扩展,用以使其含义更加明确。

如果 WHEN 子句指定了 WHEN MATCHED,并且候选变更行表示 data_source 中的一行与目标表中的一行相匹配,那么如果 condition 未指定,或其求值结果为 true,就会执行该 WHEN 子句。

如果 WHEN 子句指定了 WHEN NOT MATCHED BY SOURCE,并且候选变更行表示目标表中的某一行与 data_source 中的任何行都不匹配,那么如果 condition 未指定,或其求值结果为 true,就会执行该 WHEN 子句。

如果 WHEN 子句指定了 WHEN NOT MATCHED [BY TARGET],并且候选变更行表示 data_source 中的某一行与目标表中的任何行都不匹配,那么如果 condition 未指定,或其求值结果为 true,就会执行该 WHEN 子句。

condition #

一个返回 boolean 类型值的表达式。如果某个 WHEN 子句中的这个表达式返回 true,则会对该行执行该子句对应的动作。

WHEN MATCHED 子句上的条件可以引用源关系和目标关系中的列。WHEN NOT MATCHED BY SOURCE 子句上的条件只能引用目标关系中的列,因为按定义不存在匹配的源行。WHEN NOT MATCHED [BY TARGET] 子句上的条件只能引用源关系中的列,因为按定义不存在匹配的目标行。只能访问目标表的系统属性。

merge_insert #

用于向目标表插入一行的 INSERT 动作规范。目标列名可以按任意顺序列出。如果根本没有给出列名列表,则默认为按声明顺序使用该表的所有列。

任何未出现在显式或隐式列列表中的列都会填入默认值;如果没有声明默认值,则填入空值。

如果目标表是分区表,则每一行都会被路由到适当的分区并插入其中。如果目标表本身是一个分区,而任何输入行违反了分区约束,就会报错。

列名不得指定多次。INSERT 动作不能包含子查询。

只能指定一个 VALUES 子句。VALUES 子句只能引用源关系中的列,因为按定义不存在匹配的目标行。

merge_update #

用于更新目标表当前行的 UPDATE 动作规范。列名不得指定多次。

既不允许表名,也不允许 WHERE 子句。

merge_delete #

指定一个 DELETE 动作,用于删除目标表的当前行。不要像通常编写 DELETE 命令那样包含表名或其他子句。

column_name #

目标表中某一列的名称。如有需要,列名可以使用子字段名或数组下标进行限定。(只向复合列的部分字段插入值会使其余字段为 NULL。)在指定目标列时不要包含表名。

OVERRIDING SYSTEM VALUE #

如果没有这个子句,那么为定义为 GENERATED ALWAYS 的标识列指定显式值(除 DEFAULT 外)会报错。这个子句会覆盖该限制。

OVERRIDING USER VALUE #

如果指定了此子句,则会忽略为定义为 GENERATED BY DEFAULT 的标识列提供的任何值,并应用默认的序列生成值。

DEFAULT VALUES #

所有列都会填入各自的默认值。(这种形式不允许出现 OVERRIDING 子句。)

expression #

赋给该列的表达式。如果用于 WHEN MATCHED 子句,该表达式可以使用目标表中原始行的值以及 data_source 行的值。如果用于 WHEN NOT MATCHED BY SOURCE 子句,该表达式只能使用目标表中原始行的值。如果用于 WHEN NOT MATCHED [BY TARGET] 子句,该表达式只能使用 data_source 行的值。

DEFAULT #

将该列设为其默认值(如果没有为其指定特定的默认表达式,则为 NULL)。

sub-SELECT #

一个 SELECT 子查询,其输出列数必须与它前面的括号列列表中列出的数量相同。执行时,该子查询最多只能产生一行。如果产生一行,其列值会赋给目标列;如果不产生任何行,则向目标列赋 NULL 值。如果用于 WHEN MATCHED 子句,子查询可以引用目标表中原始行的值,以及 data_source 行的值。如果用于 WHEN NOT MATCHED BY SOURCE 子句,子查询只能引用目标表中原始行的值。

output_expression #

由 MERGE 命令在每一行发生变化后(无论是插入、更新还是删除)计算并返回的表达式。该表达式可以使用源表或目标表的任意列,也可以使用 merge_action() 函数返回关于已执行动作的附加信息。

写成* 将返回源表的全部列,然后返回目标表的全部列。这往往会导致大量重复,因为源表和目标表通常有很多相同的列。可以通过使用源表或目标表的名称或别名限定* 来避免这一点。

output_name #

用于返回列的名称。

输出

成功完成时,MERGE 命令返回如下形式的命令标签:

MERGE total_count

total_count 是发生变化的总行数(无论是插入、更新还是删除)。如果 total_count 为 0,则没有任何行以任何方式发生变化。

如果 MERGE 命令包含 RETURNING 子句,则其结果将类似于一条 SELECT 语句,包含 RETURNING 列表中定义的列和值,这些值是针对该命令插入、更新或删除的行计算得到的。

注解

在执行 MERGE 期间会发生以下步骤:

  1. 对所有已指定的动作执行任何 BEFORE STATEMENT 触发器,无论其 WHEN 子句是否匹配。

  2. 执行从源到目标表的连接。生成的查询会按常规方式优化,并产生一组候选变更行。对于每个候选变更行,

    1. 判定该行是 MATCHED、NOT MATCHED BY SOURCE 还是 NOT MATCHED [BY TARGET]。

    2. 按指定顺序测试每个 WHEN 条件,直到有一个返回 true。

    3. 当某个条件返回 true 时,执行以下动作:

      1. 执行为该动作事件类型触发的任何 BEFORE ROW 触发器。

      2. 执行指定的动作,并对目标表应用任何检查约束。

      3. 执行为该动作事件类型触发的任何 AFTER ROW 触发器。

      如果目标关系是一个视图,并且为该动作的事件类型定义了 INSTEAD OF ROW 触发器,则改由这些触发器执行该动作。

  3. 对已指定的动作执行任何 AFTER STATEMENT 触发器,无论这些动作是否实际发生。这类似于一条未修改任何行的 UPDATE 语句的行为。

总之,只要我们指定了某种动作,对应事件类型(例如 INSERT)的语句级触发器就会被触发。相反,行级触发器只会针对实际被执行的特定事件类型触发。因此,一条 MERGE 命令可能同时触发 UPDATE 和 INSERT 的语句级触发器,即使实际上只触发了 UPDATE 的行级触发器。

你应确保该连接对每个目标行最多只生成一个候选变更行。换句话说,一个目标行不应连接到多于一个数据源行。如果发生这种情况,则只会使用其中一个候选变更行来修改目标行;随后再次尝试修改该行会导致错误。如果行级触发器对目标表进行了修改,而随后这些已被修改的行又被 MERGE 再次修改,也可能发生这种情况。如果重复的动作是 INSERT,则会导致唯一性违例错误;而重复的 UPDATE 或 DELETE 则会导致基数违规;后者是 SQL 标准要求的行为。这不同于 PostgreSQL 历史上在 UPDATE 和 DELETE 语句中处理连接的行为:对同一行的第二次及后续修改尝试会被直接忽略。

如果某个 WHEN 子句省略了 AND 子句,它就会成为该类型(MATCHED、NOT MATCHED BY SOURCE 或 NOT MATCHED [BY TARGET])最后一个可达的子句。如果之后又指定了同一类型的 WHEN 子句,则可证明它不可达,并会引发错误。如果这三类中都没有指定最后一个可达子句,则候选变更行可能不会执行任何动作。

默认情况下,从数据源生成行的顺序是不确定的。如果需要,可以使用 source_query 指定一致的排序,这可能有助于避免并发事务之间的死锁。

当 MERGE 与其他修改目标表的命令并发运行时,适用通常的事务隔离规则;请参见第 13.2 节,了解各个隔离级别下的行为说明。你也可以考虑使用 INSERT ... ON CONFLICT 作为替代语句,它提供了在发生并发 INSERT 时执行 UPDATE 的能力。这两种语句类型之间存在各种差异和限制,因此不能互换。

示例

根据新的 recent_transactions 对 customer_account 执行维护。

MERGE INTO customer_account ca
USING recent_transactions t
ON t.customer_id = ca.customer_id
WHEN MATCHED THEN
  UPDATE SET balance = balance + transaction_value
WHEN NOT MATCHED THEN
  INSERT (customer_id, balance)
  VALUES (t.customer_id, t.transaction_value);

请注意,这与下面的语句完全等价,因为 MATCHED 结果在执行期间不会改变。

MERGE INTO customer_account ca
USING (SELECT customer_id, transaction_value FROM recent_transactions) AS t
ON t.customer_id = ca.customer_id
WHEN MATCHED THEN
  UPDATE SET balance = balance + transaction_value
WHEN NOT MATCHED THEN
  INSERT (customer_id, balance)
  VALUES (t.customer_id, t.transaction_value);

尝试插入一个新的库存项及其库存数量。如果该项已存在,则改为更新现有项的库存数量。不允许库存为零的条目。返回所有已发生更改的详细信息。

MERGE INTO wines w
USING wine_stock_changes s
ON s.winename = w.winename
WHEN NOT MATCHED AND s.stock_delta > 0 THEN
  INSERT VALUES(s.winename, s.stock_delta)
WHEN MATCHED AND w.stock + s.stock_delta > 0 THEN
  UPDATE SET stock = w.stock + s.stock_delta
WHEN MATCHED THEN
  DELETE
RETURNING merge_action(), w.*;

例如,wine_stock_changes 表可能是一个刚装载到数据库中的临时表。

根据替换后的酒单更新 wines:为任何新库存插入行,更新已修改的库存条目,并删除新列表中不存在的任何葡萄酒。

MERGE INTO wines w
USING new_wine_list s
ON s.winename = w.winename
WHEN NOT MATCHED BY TARGET THEN
  INSERT VALUES(s.winename, s.stock)
WHEN MATCHED AND w.stock != s.stock THEN
  UPDATE SET stock = s.stock
WHEN NOT MATCHED BY SOURCE THEN
  DELETE;

兼容性

这个命令符合 SQL 标准。

WITH 子句、WHEN NOT MATCHED 上的 BY SOURCE 和 BY TARGET 限定词、DO NOTHING 动作以及 RETURNING 子句,都是对 SQL 标准的扩展。

报告文档问题

阅读 上游文档. 通过 PostgreSQL 文档反馈表单.