<p>应使用窗口函数ROW_NUMBER()或关联子查询获取每组最新记录的status:先按group_id分组、updated_at降序排序,取rn=1的行;MySQL 5.7等旧版本可用子查询SELECT t1.* FROM t t1 WHERE t1.updated_at = (SELECT MAX(t2.updated_at) FROM t t2 WHERE t2.group_id = t1.group_id),并确保(group_id, updated_at)有复合索引。</p>

GROUP BY 后怎么取每组中 status 对应的最大 updated_at
直接用 MAX(updated_at) 只能拿到时间最大值,但拿不到该时间点对应的 status —— 因为 status 不在 GROUP BY 里,又没被聚合,多数数据库(如 PostgreSQL、MySQL 8.0+ 严格模式)会报错:column "status" must appear in the GROUP BY clause or be used in an aggregate function。
真正要的是“每组里最新那条记录的 status”,不是“所有 status 中字典序最大的那个”。
- 别写
SELECT status, MAX(updated_at) FROM t GROUP BY group_id—— 这在 MySQL 5.7 非严格模式下可能“侥幸跑通”,但结果不可靠,status和MAX(updated_at)很可能不来自同一条记录 - 推荐用窗口函数:先按
group_id分组,再按updated_at DESC排序,取每组ROW_NUMBER() = 1的行 - 示例(标准写法):
SELECT group_id, status, updated_at FROM ( SELECT group_id, status, updated_at, ROW_NUMBER() OVER (PARTITION BY group_id ORDER BY updated_at DESC) AS rn FROM your_table ) ranked WHERE rn = 1;
MySQL 5.7 或旧版 SQLite 怎么绕过窗口函数限制
这些引擎不支持 ROW_NUMBER(),得用关联子查询或自连接,性能差但兼容性强。
- 子查询方式(注意加索引!):
SELECT t1.group_id, t1.status, t1.updated_at FROM your_table t1 WHERE t1.updated_at = ( SELECT MAX(t2.updated_at) FROM your_table t2 WHERE t2.group_id = t1.group_id );
- 问题:如果同一
group_id有多个记录时间相同,会返回多行;而窗口函数默认只取一行(除非改用RANK()) - SQLite 3.25+ 其实支持窗口函数,但老版本必须用子查询;MySQL 5.7 建议升级或用应用层二次处理
要不要加 DISTINCT ON?PostgreSQL 用户注意
PostgreSQL 提供了更简洁的语法:DISTINCT ON,但它和 GROUP BY 语义不同,且依赖排序。
- 正确写法:
SELECT DISTINCT ON (group_id) group_id, status, updated_at FROM your_table ORDER BY group_id, updated_at DESC;
- 必须带
ORDER BY,且DISTINCT ON字段要出现在ORDER BY最前面,否则报错 - 它只保证每组第一条,不校验是否唯一;如果有并列最大时间,结果取决于排序稳定性(通常取物理存储顺序第一行)
- 不能和普通聚合混用,比如不能同时写
COUNT(*)—— 要统计总数得另套一层
性能关键:索引怎么建才不拖慢查询
无论用哪种写法,没索引时全表扫描会让查询从毫秒变秒级,尤其数据量 > 10 万行后。
- 核心索引字段顺序很重要:优先
(group_id, updated_at DESC),这样PARTITION BY group_id ORDER BY updated_at DESC可走索引 - 如果还要查
status,可扩展为复合索引:(group_id, updated_at DESC, status),避免回表 - MySQL 中
updated_at DESC在联合索引里实际生效(8.0+ 支持降序索引),但老版本会忽略DESC,只当升序用 - 执行前务必用
EXPLAIN看是否用了索引,特别是子查询场景,外层t1和内层t2都要命中索引
DISTINCT ON 简短却绑定 PostgreSQL;子查询通用但容易写错关联条件。最常被忽略的是索引字段顺序——group_id 必须在前,否则优化器大概率放弃使用。

















