SQL Server2005杂谈(3):四个排名函数(row_number、rank、den

2016-02-19 16:03 25 1 收藏

岁数大了,QQ也不闪了,微信也不响了,电话也不来了,但是图老师依旧坚持为大家推荐最精彩的内容,下面为大家精心准备的SQL Server2005杂谈(3):四个排名函数(row_number、rank、den,希望大家看完后能赶快学习起来。

【 tulaoshi.com - 编程语言 】

  排名函数是SQL Server2005新加的功能。在SQL Server2005中有如下四个排名函数:

  1.row_number

  2.rank

  3.dense_rank

  4.ntile  

  下面分别介绍一下这四个排名函数的功能及用法。在介绍之前假设有一个t_table表,表结构与表中的数据如图1所示:

图1

  其中field1字段的类型是int,field2字段的类型是varchar

  一、row_number

  row_number函数的用途是非常广泛,这个函数的功能是为查询出来的每一行记录生成一个序号。row_number函数的用法如下面的SQL语句所示:

selectrow_number()over(orderbyfield1)asrow_number,*fromt_table

  上面的SQL语句的查询结果如图2所示。

图2

  其中row_number列是由row_number函数生成的序号列。在使用row_number函数是要使用over子句选择对某一列进行排序,然后才能生成序号。

  实际上,row_number函数生成序号的基本原理是先使用over子句中的排序语句对记录进行排序,然后按着这个顺序生成序号。over子句中的order by子句与SQL语句中的order by子句没有任何关系,这两处的order by 可以完全不同,如下面的SQL语句所示:

selectrow_number()over(orderbyfield2desc)asrow_number,*fromt_tableorderbyfield1desc

  上面的SQL语句的查询结果如图3所示。

图3

  我们可以使用row_number函数来实现查询表中指定范围的记录,一般将其应用到Web应用程序的分页功能上。下面的SQL语句可以查询t_table表中第2条和第3条记录:

witht_rowtable
as
(
  selectrow_number()over(orderbyfield1)asrow_number,*fromt_table
)
select*fromt_rowtablewhererow_number1androw_number4orderbyfield1

  上面的SQL语句的查询结果如图4所示。

图4

(本文来源于图老师网站,更多请访问https://www.tulaoshi.com/bianchengyuyan/)

  上面的SQL语句使用了CTE,关于CTE的介绍将读者参阅《SQL Server2005杂谈(1):使用公用表表达式(CTE)简化嵌套SQL》。

  另外要注意的是,如果将row_number函数用于分页处理,over子句中的order by 与排序记录的order by 应相同,否则生成的序号可能不是有续的。

  当然,不使用row_number函数也可以实现查询指定范围的记录,就是比较麻烦。一般的方法是使用颠倒Top来实现,例如,查询t_table表中第2条和第3条记录,可以先查出前3条记录,然后将查询出来的这三条记录按倒序排序,再取前2条记录,最后再将查出来的这2条记录再按倒序排序,就是最终结果。SQL语句如下:

select*from(selecttop2*from(selecttop3*fromt_tableorderbyfield1)aorderbyfield1desc)borderbyfield1

  上面的SQL语句查询出来的结果如图5所示。

图5

  这个查询结果除了没有序号列row_number,其他的与图4所示的查询结果完全一样。

  二、rank

  rank函数考虑到了over子句中排序字段值相同的情况,为了更容易说明问题,在t_table表中再加一条记录,如图6所示。

图6

  在图6所示的记录中后三条记录的field1字段值是相同的。如果使用rank函数来生成序号,这3条记录的序号是相同的,而第4条记录会根据当前的记录数生成序号,后面的记录依此类推,也就是说,在这个例子中,第4条记录的序号是4,而不是2。rank函数的使用方法与row_number函数完全相同,SQL语句如下:

selectrank()over(orderbyfield1),*fromt_tableorderbyfield1

  上面的SQL语句的查询结果如图7所示。

图7

  三、dense_rank

  dense_rank函数的功能与rank函数类似,只是在生成序号时是连续的,而rank函数生成的序号有可能不连续。如上面的例子中如果使用dense_rank函数,第4条记录的序号应该是2,而不是4。如下面的SQL语句所示:

selectdense_rank()over(orderbyfield1),*fromt_tableorderbyfield1

  上面的SQL语句的查询结果如图8所示。

图8

  读者可以比较图7和图8所示的查询结果有什么不同

  四、ntile

  ntile函数可以对序号进行分组处理。这就相当于将查询出来的记录集放到指定长度的数组中,每一个数组元素存放一定数量的记录。ntile函数为每条记录生成的序号就是这条记录所有的数组元素的索引(从1开始)。也可以将每一个分配记录的数组元素称为“桶”。ntile函数有一个参数,用来指定桶数。下面的SQL语句使用ntile函数对t_table表进行了装桶处理:

selectntile(4)over(orderbyfield1)asbucket,*fromt_table

  上面的SQL语句的查询结果如图9所示。

图9

  由于t_table表的记录总数是6,而上面的SQL语句中的ntile函数指定了桶数为4。

  也许有的读者会问这么一个问题,SQL Server2005怎么来决定某一桶应该放多少记录呢?可能t_table表中的记录数有些少,那么我们假设t_table表中有59条记录,而桶数是5,那么每一桶应放多少记录呢?

  实际上通过两个约定就可以产生一个算法来决定哪一个桶应放多少记录,这两个约定如下:

  1.编号小的桶放的记录不能小于编号大的桶。也就是说,第1捅中的记录数只能大于等于第2桶及以后的各桶中的记录。

  2.所有桶中的记录要么都相同,要么从某一个记录较少的桶开始后面所有捅的记录数都与该桶的记录数相同。也就是说,如果有个桶,前三桶的记录数都是10,而第4捅的记录数是6,那么第5桶和第6桶的记录数也必须是6。

  根据上面的两个约定,可以得出如下的算法:

  //mod表示取余,div表示取整
  if(记录总数mod桶数==0)
  {
    recordCount=记录总数div桶数;
    将每桶的记录数都设为recordCount
  }
  else
  {
    recordCount1=记录总数div桶数+1;
    intn=1; // n表示桶中记录数为recordCount1的最大桶数
    m=recordCount1*n;
    while(((记录总数-m) mod (桶数- n)) !=0)
    {
      n++;
      m=recordCount1*n;
    }
    recordCount2=(记录总数-m)div (桶数-n);
    将前n个桶的记录数设为recordCount1
    将n+1个至后面所有桶的记录数设为recordCount2
  }

(本文来源于图老师网站,更多请访问https://www.tulaoshi.com/bianchengyuyan/)

  根据上面的算法,如果记录总数为59,桶数为5,则前4个桶的记录数都是12,最后一个桶的记录数是11。

  如果记录总数为53,桶数为5,则前3个桶的记录数为11,后2个桶的记录数为10。

  就拿本例来说,记录总数为6,桶数为4,则会算出recordCount1的值为2,在结束while循环后,会算出recordCount2的值是1,因此,前2个桶的记录是2,后2个桶的记录是1。

来源:https://www.tulaoshi.com/n/20160219/1610972.html

延伸阅读
1:使用分区表来提高数据库性能 以前的处理大数据量时很多人会采取使用多个结构相同的表按时间段来分,不同时间的数据存在不同的数据表里,这样如果只查询一个表的数据就很快,如果需要跨表查询则再通过连接视图将这些表连起来伪装成一个表的样子,这样可以提高查询效率,但牺牲了程序设计的优雅性和数据库设计的简单性,特别是在处理...
下面我们来看下,如何利用它来删除一个表中重复记录: 代码如下: If Exists(Select * From tempdb.Information_Schema.Tables Where Table_Name Like '#Temp%') Drop Table #temp Create Table #temp ([Id] int, [Name] varchar(50), [Age] int, [Sex] bit default 1) Go Insert Into #temp ([Id] , [Name] , [Age] , [Sex] ) Values(1,'J...
一、 SQLCLR权限集级别 当你使用CREATE ASSEMBLY语句把一个程序集加载到一个数据库中时,SQL Server提供了三种权限集级别:SAFE,EXTERNAL_ACCESS和UNSAFE。这些权限集形成如图3和图5(均请参考第二篇)所示的AppDomain策略级别。 下面是一个典型的语句,它实现安装位于FileLoader.dll文件内的一个程序集,并且赋予它EXTERNAL_AC...
标签: SQLServer
一、 简介 在2005年11月份,微软发行了三种新产品系列:Visual Studio 2005,SQL Server 2005和.NET框架2.0(它包括ASP.NET 2.0)。SQL Server 2005是微软自从其上一个主要发行版本SQL Server 2000以来最新版本的数据库平台。在过去五年的发展中,SQL Server中加入了大量的新特征,所有这些新内容都被总结到微软网站的一篇文章《What's New...
标签: Web开发
首先要明确一个基本原则,XML类型的数据之间以及XML类型与其它数据类型之间都是不能比较的,也就是说XML类型的数据不能出现在等号的任何一边。 大致可分为查询类,修改类和跨域查询类。 查询类包含query(),value(),exist()和nodes(). 修改类包含modify(). 跨域查询类包含sql:variable()和sql:column(). 查询类 ...

经验教程

745

收藏

43
微博分享 QQ分享 QQ空间 手机页面 收藏网站 回到头部