相关子查询需让内层引用外层字段(如t1.dept_id),通过t1.salary = (SELECT MAX(t2.salary) FROM employees t2 WHERE t2.dept_id = t1.dept_id)获取每组最大值对应原始行,兼容老版本数据库但性能较低。

相关子查询怎么写才能拿到每组最大值
直接用 GROUP BY 配合 MAX() 只能返回聚合结果,拿不到原始行的其他字段;想查出“每个部门薪资最高的人是谁”,必须用相关子查询——核心是让子查询依赖外部查询的分组字段。
典型写法是:外层查整张表,内层对每行的分组键(比如 dept_id)做一次 MAX(),再让外层这行的值等于这个最大值。
- 子查询必须引用外层表的列(如
t1.dept_id),否则就变成不相关子查询,结果全错 - 注意别漏掉
WHERE条件里的等号方向:t1.salary = (SELECT MAX(t2.salary) ...),不是>=或> - 如果同一组有多个最大值(并列第一),这条语句会返回所有并列行,这是合理行为,不是 bug
为什么不能用窗口函数替代?
如果你用的是 MySQL 8.0+、PostgreSQL 或 SQL Server,ROW_NUMBER() 或 RANK() 确实更高效也更直观。但相关子查询的优势在于兼容性:它在所有支持子查询的标准 SQL 引擎里都能跑,包括老版本 MySQL(5.7)、SQLite 甚至某些嵌入式数据库。
性能上,相关子查询是“对每行执行一次子查询”,数据量大时明显慢于窗口函数。但如果你只查几千行,或目标环境不支持窗口函数,它就是最稳妥的选择。
- MySQL 5.7 不支持
OVER(),此时相关子查询是事实标准解法 - Oracle 11g 及更早版本同理,
ROW_NUMBER()要 12c 才稳定 - 子查询中若涉及多字段比较(比如“薪资最高且入职最早”),相关子查询比窗口函数写起来反而更直白
容易被忽略的 NULL 和重复值问题
当分组字段(如 dept_id)为 NULL 时,相关子查询默认不会匹配到任何行,因为 NULL = NULL 返回 UNKNOWN,导致这些记录被过滤掉。这不是语法错误,而是 SQL 的三值逻辑特性。
另外,如果子查询里没加 WHERE t2.dept_id IS NOT NULL,而外层某行 dept_id 是 NULL,整个子查询可能返回空集,外层 salary = NULL 判断恒为 false。
- 处理
NULL分组:在外层加OR t1.dept_id IS NULL,并在子查询中单独处理NULL分支 - 避免隐式类型转换:确保子查询和外层比较的字段类型一致,比如
CHAR和VARCHAR比较可能因尾部空格失效 - 索引建议:给子查询中的关联字段(如
(dept_id, salary))建联合索引,能显著加速
一个能直接跑的示例
假设表 employees 有 id、name、dept_id、salary 四列:
SELECT e1.* FROM employees e1 WHERE e1.salary = ( SELECT MAX(e2.salary) FROM employees e2 WHERE e2.dept_id = e1.dept_id );
注意别写成 WHERE e1.salary IN (SELECT MAX(...)) —— 这种写法在 dept_id 为 NULL 时行为不可靠,且无法利用索引。
真正难的不是写出语法,而是确认你的数据里有没有 NULL 分组、重复最大值、以及目标数据库是否悄悄把子查询优化成了不相关形式——这些细节不验证,上线后查不到数据才最头疼。

















