窗口函数适用于单表分组内行间计算,如ROW_NUMBER()实现组内排序;自连接则用于跨组或多跳关联,且WHERE中不可直接引用窗口函数别名,须用子查询或CTE。

查“组内某行”还是“组间关联”?先看数据关系本质
窗口函数只适合解决「单表、分组内、行与行之间」的计算;自连接则能跨组、跨逻辑层级甚至多跳关联。比如要找“每个部门工资第二高的员工”,这是典型的组内排序问题,ROW_NUMBER()或DENSE_RANK()就能搞定;但若要找“每个A部门员工和B部门薪资最接近的员工配对”,这就必须用自连接——窗口函数连跨表都做不到,更别说跨分组匹配。
ORDER BY 没写稳,窗口函数就等于没写
几乎所有窗口函数翻车,都源于ORDER BY没写对。漏掉它,MySQL 8.0 和 SQL Server 会直接报错 ERROR 3589 (HY000): Window '<unnamed>' requires an ORDER BY clause</unnamed>;PostgreSQL 虽不报错,但结果不可复现。更隐蔽的坑是只写ORDER BY created_at却忽略重复时间戳——同一秒可能有几十条订单,数据库每次选的“第一行”都不同。必须补二级排序,比如ORDER BY created_at DESC, id DESC,否则rn = 1取出来的根本不是你要的“最新”记录。
LAG/LEAD 能替代的自连接,往往藏着 ID 连续性幻觉
看到JOIN t1 ON t2.id = t1.id + 1这种写法,基本可以判定是硬伤。生产环境里id从不连续:删过数据、批量导入、分库分表主键、雪花算法……都会让这个等式失效。而LAG(amount) OVER (PARTITION BY user_id ORDER BY event_time)完全不依赖物理 ID,只认你定义的逻辑顺序。但注意:LAG()返回NULL时会污染后续计算,比如amount - LAG(amount)变成NULL,得用COALESCE(LAG(amount), 0)兜底。
WHERE 中不能直接引用窗口函数别名
写SELECT ..., ROW_NUMBER() OVER (...) AS rn FROM t WHERE rn = 1会报错——SQL 标准规定WHERE执行早于窗口函数计算。必须套一层子查询或 CTE:SELECT * FROM (SELECT ..., ROW_NUMBER() OVER (...) AS rn FROM t) t2 WHERE rn = 1。这个嵌套开销几乎为零,但漏掉就会卡在语法层。另外,RANK()和ROW_NUMBER()行为差异极大:并列时前者给相同排名(1,1,3),后者强制唯一(1,2,3);你要的是“并列第二高薪者”,就得用DENSE_RANK(),而不是凭感觉选。

















