必须用窗口函数生成行号再嵌套子查询定位中位数,WHERE中不可直接用ROW_NUMBER();奇偶统一用FLOOR((n+1)/2)和FLOOR((n+2)/2)取行号;分组中位数须PARTITION BY;需先过滤NULL并用ROW_NUMBER()。

子查询必须配合窗口函数才能准确定位中位数位置
单纯用 WHERE + 子查询无法直接定位“第 N 行”,因为标准 SQL 不允许在 WHERE 中引用行号。必须先用窗口函数(如 ROW_NUMBER())生成序号,再把整个带序号的结果作为子查询(即 FROM 型子查询),最后在外层用 WHERE 筛选行号。否则会报错 Invalid use of window function 或直接语法不通过。
常见错误写法:SELECT salary FROM employees WHERE ROW_NUMBER() OVER (ORDER BY salary) = ...
这是非法的——窗口函数不能出现在 WHERE 子句中。
正确结构是:
- 内层:用
ROW_NUMBER()和COUNT(*) OVER()同时计算每行序号和总行数 - 中间:把内层结果作为临时表(必须加别名,如
AS tmp) - 外层:用
WHERE rn IN (...)筛选目标行号
奇偶统一处理的关键是两个行号表达式
中位数逻辑本质就两条:奇数个取中间那个,偶数个取中间两个的平均值。对应到行号上,就是取第 FLOOR((n+1)/2) 和 FLOOR((n+2)/2) 行(n 为总行数)。这两个表达式在奇偶场景下自动收敛为 1 个或 2 个值,无需 CASE WHEN 判断。
例如:
- n = 5 →
FLOOR(6/2)=3,FLOOR(7/2)=3→ 只取第 3 行 - n = 6 →
FLOOR(7/2)=3,FLOOR(8/2)=4→ 取第 3、4 行求均值
注意:(n+1)/2 和 (n+2)/2 必须用 FLOOR,不能用 CEIL 或四舍五入,否则在某些数据库(如 MySQL 8.0 之前)中可能因浮点精度出错;也不建议写成 (n-1)/2 + 1,语义不直观且易漏括号。
GROUP BY 分组中位数必须用 PARTITION BY
如果要算「每个公司」或「每个部门」的薪资中位数,不能靠外层 GROUP BY 配合全局行号——那样所有数据混排,行号失去分组意义。必须在窗口函数里用 PARTITION BY company,让 ROW_NUMBER() 和 COUNT(*) OVER() 都按组独立计算。
典型错误是只写 ORDER BY salary 却漏掉 PARTITION BY,结果得到的是全表排序下的行号,不是各公司内部排序后的行号。
正确写法片段:
SELECT company, AVG(salary) AS median
FROM (
SELECT company, salary,
ROW_NUMBER() OVER (PARTITION BY company ORDER BY salary) AS rn,
COUNT(*) OVER (PARTITION BY company) AS cnt
FROM zws_demo
) AS tmp
WHERE rn IN (FLOOR((cnt + 1) / 2), FLOOR((cnt + 2) / 2))
GROUP BY company;
空值和重复值会直接影响中位数结果
salary 字段若含 NULL,ROW_NUMBER() 仍会为其分配序号(取决于 ORDER BY 的 NULLS FIRST/LAST 行为),但中位数定义本身不包含空值。所以实际使用前应显式过滤:WHERE salary IS NOT NULL。
重复值不影响 ROW_NUMBER() 的唯一性(它强制编号),但如果你希望相同薪资被赋予相同排名,得换用 RANK() 或 DENSE_RANK() ——不过这会导致中位数定义模糊(比如 5 个相同值,RANK() 全给 1,无法定位“中间”)。因此计算中位数一律推荐用 ROW_NUMBER(),并提前去空。
容易被忽略的一点:某些旧版 MySQL(如 5.7)不支持窗口函数,此时只能用变量模拟(@rowindex:=@rowindex+1),但变量方式在多线程或复杂查询中不稳定,优先升级或改用支持窗口函数的引擎。

















