RANK()跳号是标准行为而非bug,因其语义为“并列同名次且后续名次跳过被占位数”,如分数100、95、95、88对应排名1、2、2、4;需改用DENSE_RANK()消除跳号,且必须通过子查询或CTE在WHERE中过滤。

RANK() 跳号是标准行为,不是 bug
RANK() 的“跳号”完全符合 SQL 标准(SQL:2003 起固化),它的定义就是:**并列同名次,后续名次跳过被占用的序号**。比如分数为 100, 95, 95, 88,RANK() OVER (ORDER BY score DESC) 返回的是 1, 2, 2, 4——不是计算错了,而是第 2 名这个位置被逻辑上“预留”给了“比 95 大但小于 100”的那个不存在的档位。
这反映的是「段位层级」:两个 95 分属于同一竞争段位(第二档),下一段位直接是第三档(对应 88 分),所以叫第 4 名。奥运奖牌榜就是典型应用:双金牌 → 铜牌是第三名,没有银牌。
为什么不能在 WHERE 中直接过滤 RANK() 结果
窗口函数执行时机晚于 WHERE,所以写 WHERE rank 会报错(MySQL 8.0 / PostgreSQL / SQL Server 全部拒绝)。常见错误写法:
SELECT *, RANK() OVER (ORDER BY revenue DESC) AS rnk FROM sales WHERE rnk <= 3;
正确做法只有两种:
- 用子查询包裹:
SELECT * FROM (SELECT *, RANK() OVER (ORDER BY revenue DESC) AS rnk FROM sales) t WHERE t.rnk - 用 CTE 更清晰:
WITH ranked AS (SELECT *, RANK() OVER (ORDER BY revenue DESC) AS rnk FROM sales) SELECT * FROM ranked WHERE rnk
该用 RANK() 还是 DENSE_RANK()?看业务语义
选错函数会导致结果逻辑错位,不是风格问题:
- 用
RANK()的场景:强调“跨越了多少个不同值”,比如“客户消费额落在前 5 档中的哪几档”、奥运排名、考试名次公示 - 用
DENSE_RANK()的场景:要求名次连续无空档,比如按销售额分 A/B/C 三档(必须有且仅有三档)、班级内成绩排名需可读性强 - 注意:
DENSE_RANK()仍需子查询过滤;它不合并行,只是编号连续;若 10 人并列第 2 名,WHERE dense_rank 会返回 12 行(2 个第 1 名 + 10 个第 2 名)
PARTITION BY 和 ORDER BY 写错会彻底歪掉排名
漏写 PARTITION BY 导致全表排名而非分组内排名,是高频低级错误。例如想算“每科成绩的班级内排名”,却只写 RANK() OVER (ORDER BY score DESC),结果是全校统排。
ORDER BY 字段顺序决定并列边界:
-
ORDER BY sales DESC, hire_date ASC:仅当sales相同时才用hire_date排序 - 误写成
ORDER BY hire_date ASC, sales DESC:先按入职时间排,可能导致新员工 99 万排在老员工 100 万之前 - 建议在多字段排序时加唯一列(如
emp_id)避免不确定性:ORDER BY salary DESC, emp_id
真正容易被忽略的点:NULL 值默认排序行为因数据库而异(PostgreSQL/Oracle 支持 NULLS LAST,MySQL 8.0 不支持),必要时用 COALESCE(score, 0) 统一处理。

















