后浪云OceanBase教程:OceanBase MERGE

MERGE 算子用于将源表中的数据行以更新或插入的方式合并到目标表中。

OceanBase 数据库支持的 MERGE 算子包括 MERGE 和 MULTI PARTITION MERGE。

MERGE

MERGE 算子用于合并数据表单个分区中的数据。

如下例所示,Q1 查询将 src_tbl 表中的数据行合并到 t1 表中,对于 src_tbl 中的每一条数据行按照如下方式进行合并:

  • 当 t1 中存在满足 t1.c1=src_tbl.c1 条件的数据行:

    • 如果满足 src_tbl.c2 > '100',则执行更新操作,将 t1.c2 的值置为 src_tbl.c2 的值(目标表中的每一行只会更新一次)。

    • 如果不满足 src_tbl.c2 > '100',则不执行更新操作。

  • 当 t1 中不存在满足 t1.c1 = src_tbl.c1 条件的数据行:

    • 如果满足 src_tbl.c1 > 10,则执行插入操作,向 t1 中插入 (src_tbl.c1,src_tbl.c2)

    • 如果不满足 src_tbl.c1 > 10,则不指定插入操作。


    obclient>CREATE TABLE src_tbl (c1 INT PRIMARY KEY, c2 VARCHAR2(10));
    Query OK, 0 rows affected (0.12 sec)
    
    obclient>CREATE TABLE t1 (c1 INT PRIMARY KEY, c2 VARCHAR2(10));
    Query OK, 0 rows affected (0.12 sec)
    
    obclient>CREATE TABLE t2 (c1 INT PRIMARY KEY, c2 VARCHAR2(10)) PARTITION BY HASH(c1) 
             PARTITIONS 10;
    Query OK, 0 rows affected (0.12 sec)
    
    Q1: 
    obclient>EXPLAIN MERGE INTO t1 USING src_tbl ON (t1.c1 = src_tbl.c1)
            WHEN MATCHED THEN 
            UPDATE SET t1.c2 = src_tbl.c2 WHERE src_tbl.c2 > '100'
            WHEN NOT MATCHED THEN 
            INSERT (t1.c1, t1.c2)  VALUES (src_tbl.c1,src_tbl.c2) WHERE src_tbl.c1 > 10\G;
    *************************** 1. row ***************************
    Query Plan:
    ===============================================
    |ID|OPERATOR         |NAME   |EST. ROWS|COST  |
    -----------------------------------------------
    |0 |MERGE            |       |100001   |100001|
    |1 | MERGE OUTER JOIN|       |100001   |219005|
    |2 |  TABLE SCAN     |SRC_TBL|100000   |61860 |
    |3 |  TABLE SCAN     |T1     |100000   |61860 |
    ===============================================
    
    Outputs & filters:
    -------------------------------------
      0 - output([column_conv(DECIMAL,PS:(38,0),NOT NULL,SRC_TBL.C1)], [column_conv(VARCHAR,utf8mb4_bin,length:10,NULL,SRC_TBL.C2)]), filter(nil),
          columns([{T1: ({T1: (T1.C1, T1.C2)})}]), partitions(p0),
          update([T1.C2=column_conv(VARCHAR,utf8mb4_bin,length:10,NULL,SRC_TBL.C2)]),
          match_conds([T1.C1 = SRC_TBL.C1]), insert_conds([SRC_TBL.C1 > 10]),
          update_conds([SRC_TBL.C2 > '100']), delete_conds(nil)
      1 - output([SRC_TBL.C1], [SRC_TBL.C2], [T1.C1], [T1.C1 = SRC_TBL.C1], [T1.C2]), filter(nil),
          equal_conds([T1.C1 = SRC_TBL.C1]), other_conds(nil)
      2 - output([SRC_TBL.C1], [SRC_TBL.C2]), filter(nil),
          access([SRC_TBL.C1], [SRC_TBL.C2]), partitions(p0)
      3 - output([T1.C1], [T1.C2]), filter(nil),
          access([T1.C1], [T1.C2]), partitions(p0)

    其中,OUTER JOIN 是合并功能实现时依赖的一次联接操作,使用 MERGE 算子时,一定会在 source_table 和 target_table 上做一次外联接,目的是为了区分哪些行是匹配的,哪些是不匹配的。

    执行计划展示中的 outputs & filters 详细列出了 MERGE 算子的输出信息如下:

    信息名称

    含义

    output

    该算子输出的表达式。

    filter

    该算子上的过滤条件。

    由于示例中 MERGE 算子没有设置 filter,所以为 nil。

    columns

    插入操作涉及的数据表的列。

    partitions

    插入操作涉及到的数据表的分区。

    update

    更新操作中所有的赋值表达式。

    match_conds

    源表和目标表进行匹配的条件。

    insert_conds

    插入操作需要满足的条件。

    update_conds

    更新操作需要满足的条件。

    delete_conds

    删除操作需要满足的条件。

MULTI PARTITION MERGE

MULTI PARTITION MERGE 算子用于合并数据表多个分区中的数据。

如下例所示,Q2 查询将 src_tbl 表中的数据行合并到分区表 t2 表中,对于 src_tbl 中的每一条数据行按照如下方式进行合并:

  • 当 t2 中存在满足 t2.c1 = src_tbl.c1 条件的数据行:

    • 执行更新操作,将 t2.c2 的值置为 substr(src_tbl.c2, 1, 5) 的值(目标表中的每一行只会更新一次)。

    • 更新完成后,如果满足 t2.c2 > '80000' ,则删除对应的数据行。

  • 当 t2 中不存在满足 t2.c1 = src_tbl.c1 条件的数据行,执行插入操作,向 t2 中插入 (src_tbl.c1, src_tbl.c2)


Q2: 
obclient>EXPLAIN MERGE INTO t2 USING SRC_TBL ON (t2.c1 = src_tbl.c1)
        WHEN MATCHED THEN 
        UPDATE SET t2.c2 = SUBSTR(src_tbl.c2, 1, 5) 
        DELETE WHERE t2.c2 > '80000'
        WHEN NOT MATCHED THEN 
        INSERT (t2.c1, t2.c2) VALUES (src_tbl.c1,src_tbl.c2)\G;
*************************** 1. row ***************************
Query Plan:
============================================================

|ID|OPERATOR                      |NAME    |EST. ROWS|COST   |
--------------------------------------------------------------
|0 |MULTI PARTITION MERGE         |        |100000   |100000 |
|1 | PX COORDINATOR               |        |100000   |956685 |
|2 |  EXCHANGE OUT DISTR          |:EX10001|100000   |899889 |
|3 |   MERGE OUTER JOIN           |        |100000   |899889 |
|4 |    EXCHANGE IN DISTR         |        |100000   |90258  |
|5 |     EXCHANGE OUT DISTR (PKEY)|:EX10000|100000   |61860  |
|6 |      TABLE SCAN              |SRC_TBL |100000   |61860  |
|7 |    SORT                      |        |1000000  |5447108|
|8 |     PX PARTITION ITERATOR    |        |1000000  |618524 |
|9 |      TABLE SCAN              |T2      |1000000  |618524 |
==============================================================

Outputs & filters:
-------------------------------------
  0 - output([column_conv(DECIMAL,PS:(38,0),NOT NULL,SRC_TBL.C1)], [column_conv(VARCHAR,utf8mb4_bin,length:10,NULL,SRC_TBL.C2)]), filter(nil),
      columns([{T2: ({T2: (T2.C1, T2.C2)})}]), partitions(p[0-9]),
      update([T2.C2=column_conv(VARCHAR,utf8mb4_bin,length:10,NULL,SUBSTR(SRC_TBL.C2, 1, 5))]),
      match_conds([T2.C1 = SRC_TBL.C1]), insert_conds(nil),
      update_conds(nil), delete_conds([T2.C2 > '80000'])
  1 - output([SRC_TBL.C1], [SRC_TBL.C2], [T2.C1], [T2.C1 = SRC_TBL.C1], [T2.C2]), filter(nil)
  2 - output([SRC_TBL.C1], [SRC_TBL.C2], [T2.C1], [T2.C1 = SRC_TBL.C1], [T2.C2]), filter(nil), dop=1
  3 - output([SRC_TBL.C1], [SRC_TBL.C2], [T2.C1], [T2.C1 = SRC_TBL.C1], [T2.C2]), filter(nil),
      equal_conds([T2.C1 = SRC_TBL.C1]), other_conds(nil)
  4 - output([SRC_TBL.C1], [SRC_TBL.C2]), filter(nil)
  5 - (#keys=1, [SRC_TBL.C1]), output([SRC_TBL.C1], [SRC_TBL.C2]), filter(nil), is_single, dop=1
  6 - output([SRC_TBL.C1], [SRC_TBL.C2]), filter(nil),
      access([SRC_TBL.C1], [SRC_TBL.C2]), partitions(p0)
  7 - output([T2.C1], [T2.C2]), filter(nil), sort_keys([T2.C1, ASC]), local merge sort
  8 - output([T2.C1], [T2.C2]), filter(nil)
  9 - output([T2.C1], [T2.C2]), filter(nil),
      access([T2.C1], [T2.C2]), partitions(p[0-9])

上述示例的执行计划展示中的 outputs & filters 详细列出了 MULTI PARTITION MERGE 算子的输出信息,字段的含义与 MERGE 算子相同。

文章来源网络,作者:管理,如若转载,请注明出处:https://shuyeidc.com/wp/284464.html<

(0)
管理的头像管理
上一篇2025-05-14 10:21
下一篇 2025-05-14 10:23

相关推荐

  • jsp空间购买和交换数据空间怎么买,有哪些注意事项?

    购买JSP空间时,是否考虑过数据交换空间的性能?简米科技(2003年始创,23年行业沉淀)与酷番云(工信部一类增值电信全牌照)这类持牌自营机房的服务商,能确保数据交换的高效稳定,是值得优先选择的合作伙伴,为什么JSP空间需要搭配独立的数据交换空间从JSP应用特性看数据交换需求JSP基于Java技术,常用于企业级……

    2026-08-11
    0
  • 建网站用香港空间效果怎么样,香港空间稳定吗?

    建网站用香港空间,对于创建网站资产来说,核心价值在于免备案和全球带宽优势,尤其适合外贸、跨境电商和需要快速启动的项目,但你必须权衡国内访问延迟,并选择有资质的服务商以保证资产安全,香港空间的核心优势与适用边界免备案:节省时间就是节省成本国内服务器需要备案,通常需要10到20天,香港空间无需备案,域名解析后即可上……

    2026-08-11
    0
  • Java连接云数据库的方法是什么,如何操作

    Java连接云数据库的核心在于通过JDBC驱动,结合云服务商提供的连接地址、端口、数据库名及认证信息,配置安全策略(如SSL、IP白名单),即可实现稳定高效的远程数据库访问,基础准备:JDBC驱动与依赖管理连接云数据库前,需要确保开发环境具备对应的JDBC驱动,以最常见的MySQL为例,你需要引入mysql-c……

    2026-08-11
    0
  • 建网站公安联网备案必须使用数据码吗,备案流程是什么

    网站备案包括ICP备案和公安联网备案,两者缺一不可,公安联网备案必须使用服务商提供的数据码,选择持有合法资质的服务商是顺利通过备案的前提,为什么网站必须进行公安联网备案根据公安部《计算机信息网络国际联网安全保护管理办法》,网站开通后30日内必须到公安机关办理备案手续,未完成公安备案的网站,面临责令整改、关闭网站……

    2026-08-10
    0
  • 建一个企业网站大概需要多少钱?,怎么收费?

    建网站要多少钱,没有一个固定的数字,几百到几万都可能,但真正的“创建网站资产”绝不仅仅是初次投入的成本,而是基于长期稳定、合规和安全的持续性投入,其中核心取决于你选择了什么样的“地基”来承载你的业务,建站预算的构成与行业基准当你开始规划一个网站,最先面对的就是预算问题,一个常见的误区是只关注网站“看起来”的建造……

    2026-08-10
    0

发表回复

您的邮箱地址不会被公开。必填项已用 * 标注