我们该如何设计数据库(五)

最近真是忙翻天了,该是有三个月没写博客了。

这次的需求是在Mongo的使用中碰到的,但是我觉得把这个需求放进传统的RDBMS中更易于理解。需求是这样的:假设你数据库使用的是Sqlserver,有一张表,500W条数据,你要做一个随机在表中选择一条数据的功能。

假设本文所探讨的数据结构如图(聚集索引在Pk上,UserName上加了非聚集索引):

你的***反应大概是:哎呀妈呀忒巧了,正好主键使用的是Int自增的,我只用生成一个随机数,然后找这个随机数对应的主键就好了

实现的步骤大概是:

①返回数据库中ID的***值IdMax 

②生成1到IdMax中间一个的随机数 int random = new Random().Next(1,IdMax);

③使用UserID = random作为条件查询

④如果没有查询到数据,则重新生成一个随机数,再次查找(因为某个UserID的数据可能被删除了)

这种方法简单,暴力,但是有一个致命的问题:我这里在建表的时候为了说明这种方法,所以主键使用的是Int,但是在大多数我所知道的生产环境中,其实是用Guid的。这个致命的问题会直接导致上面的那个方法不可用。

至于为什么大多数我所知道的生产环境中用Guid而不用Int,我下一篇会做出对比。

既然Int在使用Guid作为主键的时候不能用,那么我们就用Row_Number吧。Sqlserver必然是支持Row_Number的,貌似Oracle和MySql中也有类似概念(不确定,问同事得到了肯定答复,没有深究)。

实现的步骤大概是:

①返回数据库中数据的总条数count

②生成1到count中间一个的随机数 int random = new Random().Next(1,count);

③查找Row_Number = random的那条数据

但是Row_Number有个极其不好的地方,就是查询越后面的数据越慢,越吃资源。但凡是将数据有序储存的数据库基本都有这个问题,比如说下面两条语句:

  1. select * from 
  2. (SELECT  UserID,UserName,Password,Sex,City,ROW_NUMBER()OVER(ORDER BY CURRENT_TIMESTAMPas Number  
  3.   FROM [User_db].[dbo].[Users] ) as query  
  4.   where query.Number = 20  
  5.     
  6.     
  7. select * from 
  8. (SELECT  UserID,UserName,Password,Sex,City,ROW_NUMBER()OVER(ORDER BY CURRENT_TIMESTAMPas Number  
  9.   FROM [User_db].[dbo].[Users] ) as query  
  10.   where query.Number = 5000000 

***条查Row_Number=20的数据,logical reads 5.elapsed time = 58 ms.

第二条查Row_Number=5000000的数据,logical reads 90208.elapsed time = 900 ms.

可以明显的看出,后者的逻辑读次数多了太多,而运行速度也慢了不少。如果这个功能比较频繁使用,比如说这是向用户随机推荐好用的功能,那么这个将会成为一个性能瓶颈

有的网友说使用这句:

  1. SELECT TOP 1 * FROM Users ORDER BY NEWID()  

这个运行出来结果是正确的,但是效率却大打折扣。比如说我查到了第1336793条数据,logical reads 90208,elapsed time = 3026 ms

查看执行计划,发现Sort占用了98%:

有没有比Row_Number更好一点的方法?

答案是在表中再加一列Random列,使得数据结构变更成这样:

在添加数据的时候,就生成一个随机数插入进来。按照本篇的例子来说,一开始可以生成0到一亿之间的随机数插入。注意,要在Random上加索引。

实现的步骤大概是:

①插入数据的时候添加一个随机

②生成一个随机数,查询 select top(1) * from Users where Random > 随机数

③这个查询的结果可能会有多条(但不会很多),再在这个多条数据中随机筛选其一(使用Linq可以很方便的实现,不赘述)

好了,基本说完了,请允许我在结尾卖个萌:聪明的读者,开动脑筋,您还有更好的方法么?如果有,请留言。

原文链接:http://www.cnblogs.com/CrazyJinn/archive/2013/03/19/2968769.html

文章来源网络,作者:运维,如若转载,请注明出处:https://shuyeidc.com/wp/300520.html<

(0)
运维的头像运维
上一篇2025-05-23 22:01
下一篇 2025-05-23 22:02

相关推荐

  • 个人主题怎么制作?

    制作个人主题是一个将个人风格、兴趣或专业领域转化为视觉化或结构化内容的过程,无论是用于个人博客、作品集、社交媒体账号还是品牌形象,核心都是围绕“个人特色”展开,以下从定位、内容规划、视觉设计、技术实现四个维度,详细拆解制作个人主题的完整流程,明确主题定位:找到个人特色的核心主题定位是所有工作的起点,需要先回答……

    2025-11-20
    0
  • 社群营销管理关键是什么?

    社群营销的核心在于通过建立有温度、有价值、有归属感的社群,实现用户留存、转化和品牌传播,其管理需贯穿“目标定位-内容运营-用户互动-数据驱动-风险控制”全流程,以下从五个维度展开详细说明:明确社群定位与目标社群管理的首要任务是精准定位,需明确社群的核心价值(如行业交流、产品使用指导、兴趣分享等)、目标用户画像……

    2025-11-20
    0
  • 香港公司网站备案需要什么材料?

    香港公司进行网站备案是一个涉及多部门协调、流程相对严谨的过程,尤其需兼顾中国内地与香港两地的监管要求,由于香港公司注册地与中国内地不同,其网站若主要服务内地用户或使用内地服务器,需根据服务器位置、网站内容性质等,选择对应的备案路径(如工信部ICP备案或公安备案),以下从备案主体资格、流程步骤、材料准备、注意事项……

    2025-11-20
    0
  • 如何企业上云推广

    企业上云已成为数字化转型的核心战略,但推广过程中需结合行业特性、企业痛点与市场需求,构建系统性、多维度的推广体系,以下从市场定位、策略设计、执行落地及效果优化四个维度,详细拆解企业上云推广的实践路径,精准定位:明确目标企业与核心价值企业上云并非“一刀切”的方案,需先锁定目标客户群体,提炼差异化价值主张,客户分层……

    2025-11-20
    0
  • PS设计搜索框的实用技巧有哪些?

    在PS中设计一个美观且功能性的搜索框需要结合创意构思、视觉设计和用户体验考量,以下从设计思路、制作步骤、细节优化及交互预览等方面详细说明,帮助打造符合需求的搜索框,设计前的规划明确使用场景:根据网站或APP的整体风格确定搜索框的调性,例如极简风适合细线条和纯色,科技感适合渐变和发光效果,电商类则可能需要突出搜索……

    2025-11-20
    0

发表回复

您的邮箱地址不会被公开。必填项已用 * 标注