MySQL多列索引的应用

多列索引

我们经常听到一些人说”把WHERE条件里的列都加上索引”,其实这个建议非常错误。在多个列上建立单独的索引大部分情况下并不能提高MySQL的查询性能。MySQL在5.0之后引入了一种叫“索引合并”(index merge)的策略,一定程度上可以使用表上的多个单列索引来定位指定的行。但是当服务器对多个索引做联合操作时,通常需要耗费大量CPU和内存资源在算法的缓存、排序和合并操作上,特别是当其中有些索引的选择性不高,需要合并扫描大量的数据的时候。

这个时候,我们需要一个多列索引。

案例

创建一个测试数据库和数据表:

  1. CREATE DATABASE IF NOT EXISTS db_test default charset utf8 COLLATE utf8_general_ci;  
  2. use db_test; 
  3. CREATE TABLE payment (   
  4.     id         INT UNSIGNED NOT NULL AUTO_INCREMENT,   
  5.     staff_id  INT UNSIGNED NOT NULL,   
  6.     customer_id INT UNSIGNED NOT NULL,   
  7.     PRIMARY KEY (id) 
  8. ) ENGINE=InnoDB DEFAULT CHARSET=utf8;  

插入1000w行随机数据(利用存储过程):

  1. DROP PROCEDURE IF EXISTS add_payment;   
  2. DELIMITER // 
  3.     create PROCEDURE add_payment(in num INT
  4.     BEGIN 
  5.         DECLARE rowid INT DEFAULT 0; 
  6.         SET @exesql = 'INSERT INTO payment(staff_id, customer_id) values (?, ?)'
  7.         WHILE rowid < num DO 
  8.             SET @staff_id = (1 + FLOOR(5000*RAND()) );  
  9.             SET @customer_id = (1 + FLOOR(500000*RAND())); 
  10.             SET rowid = rowid + 1; 
  11.             prepare stmt FROM @exesql; 
  12.             EXECUTE stmt USING @staff_id, @customer_id;             
  13.         END WHILE; 
  14.     END // 
  15. DELIMITER ;  

或者你可以直接下载使用我的测试数据(也是利用上面的存储过程,但是我之后调整了数据):

测试数据

添加两个单列索引(执行过程要花点时间,建议分开一句一句执行):

  1. ALTER TABLE `payment` ADD INDEX idx_customer_id(`customer_id`); 
  2.  
  3. ALTER TABLE `payment` ADD INDEX idx_staff_id(`staff_id`);  

查询一条数据利用到两个列的索引:

  1. select count(*) from payment where staff_id = 2205 AND customer_id = 93112; 

查看执行计划:

  1. mysql> explain select count(*)  from payment  where staff_id =  2205  AND customer_id =  93112; 
  2. +----+-------------+---------+-------------+------------------------------+------------------------------+---------+------+-------+-------------------------------------------------------------------------+ 
  3. | id | select_type | table   | type        | possible_keys                | key                          | key_len | ref  | rows  | Extra                                                                   | 
  4. +----+-------------+---------+-------------+------------------------------+------------------------------+---------+------+-------+-------------------------------------------------------------------------+ 
  5. |  1 | SIMPLE      | payment | index_merge | idx_customer_id,idx_staff_id | idx_staff_id,idx_customer_id | 4,4     | NULL | 11711 | Using intersect(idx_staff_id,idx_customer_id); Using where; Using index | 
  6. +----+-------------+---------+-------------+------------------------------+------------------------------+---------+------+-------+-------------------------------------------------------------------------+ 
  7. 1 row in set (0.00 sec) 

可以看到type是index_merge,Extra中提示Using intersect(idx_staff_id,idx_customer_id);

这便是索引合并,利用两个索引,然后合并两个结果(取交集或者并集或者两者都有)

查询结果:

  1. mysql> select count(*)  from payment  where staff_id =  2205  AND customer_id =  93112 ; 
  2. +----------+ 
  3. count(*) | 
  4. +----------+ 
  5. |   178770 | 
  6. +----------+ 
  7. 1 row in set (0.12 sec)  

然后删除以上索引,添加多列索引:

  1. ALTER TABLE payment DROP INDEX idx_customer_id; 
  2.  
  3. ALTER TABLE payment DROP INDEX idx_staff_id; 
  4.  
  5. ALTER TABLE `payment` ADD INDEX idx_customer_id_staff_id(`customer_id`, `staff_id`);  

注意,多列索引很关注索引列的顺序(因为customer_id的选择性更大,所以把它放前面)

查询:

  1. mysql> select count(*)  from payment  where staff_id =  2205  AND customer_id =  93112; 
  2. +----------+ 
  3. count(*) | 
  4. +----------+ 
  5. |   178770 | 
  6. +----------+ 
  7. 1 row in set (0.05 sec)  

发现多列索引加快的查询(这里数据量还是较小,更大的时候比较更明显)

注意

多列索引的列顺序至关重要,如何选择索引的列顺序有一个经验法则:将选择性***的列放到索引最前列(但是不是绝对的)。经验法则考虑全局的基数和选择性,而不是某个具体的查询:

  1. mysql> select count(DISTINCT staff_id) / count(*) AS staff_id_selectivity, count(DISTINCT customer_id) / count(*) AS customer_id_selectivity, count(*) from payment\G; 
  2. *************************** 1. row *************************** 
  3.    staff_id_selectivity: 0.0005 
  4. customer_id_selectivity: 0.0500 
  5.                count(*): 10000000 
  6. 1 row in set (6.29 sec)  

customer_id的选择性更高,所以将它作为索引列的***位。

多列索引只能匹配最左前缀,也就是说:

  1. select * from payment  where staff_id =  2205  AND customer_id =  93112 ; 
  2. select count(*)  from payment  where  customer_id =  93112 ;  

可以利用索引,但是

  1. select * from payment where staff_id = 2205 ; 

不能利用索引。 

文章来源网络,作者:管理,如若转载,请注明出处:https://shuyeidc.com/wp/289638.html<

(0)
管理的头像管理
上一篇2025-05-16 21:26
下一篇 2025-05-16 21:27

相关推荐

  • jsp空间购买和交换数据空间怎么买,有哪些注意事项?

    购买JSP空间时,是否考虑过数据交换空间的性能?简米科技(2003年始创,23年行业沉淀)与酷番云(工信部一类增值电信全牌照)这类持牌自营机房的服务商,能确保数据交换的高效稳定,是值得优先选择的合作伙伴,为什么JSP空间需要搭配独立的数据交换空间从JSP应用特性看数据交换需求JSP基于Java技术,常用于企业级……

    2026-08-11
    0
  • 建网站用香港空间效果怎么样,香港空间稳定吗?

    建网站用香港空间,对于创建网站资产来说,核心价值在于免备案和全球带宽优势,尤其适合外贸、跨境电商和需要快速启动的项目,但你必须权衡国内访问延迟,并选择有资质的服务商以保证资产安全,香港空间的核心优势与适用边界免备案:节省时间就是节省成本国内服务器需要备案,通常需要10到20天,香港空间无需备案,域名解析后即可上……

    2026-08-11
    0
  • Java连接云数据库的方法是什么,如何操作

    Java连接云数据库的核心在于通过JDBC驱动,结合云服务商提供的连接地址、端口、数据库名及认证信息,配置安全策略(如SSL、IP白名单),即可实现稳定高效的远程数据库访问,基础准备:JDBC驱动与依赖管理连接云数据库前,需要确保开发环境具备对应的JDBC驱动,以最常见的MySQL为例,你需要引入mysql-c……

    2026-08-11
    0
  • 建网站公安联网备案必须使用数据码吗,备案流程是什么

    网站备案包括ICP备案和公安联网备案,两者缺一不可,公安联网备案必须使用服务商提供的数据码,选择持有合法资质的服务商是顺利通过备案的前提,为什么网站必须进行公安联网备案根据公安部《计算机信息网络国际联网安全保护管理办法》,网站开通后30日内必须到公安机关办理备案手续,未完成公安备案的网站,面临责令整改、关闭网站……

    2026-08-10
    0
  • 建一个企业网站大概需要多少钱?,怎么收费?

    建网站要多少钱,没有一个固定的数字,几百到几万都可能,但真正的“创建网站资产”绝不仅仅是初次投入的成本,而是基于长期稳定、合规和安全的持续性投入,其中核心取决于你选择了什么样的“地基”来承载你的业务,建站预算的构成与行业基准当你开始规划一个网站,最先面对的就是预算问题,一个常见的误区是只关注网站“看起来”的建造……

    2026-08-10
    0

发表回复

您的邮箱地址不会被公开。必填项已用 * 标注