KEEP必须配合MAX/MIN等聚合函数使用,不能单独出现;其作用是在分组排序后取指定位置(FIRST/LAST)对应行的字段值,语法为MAX(col) KEEP (DENSE_RANK FIRST ORDER BY sort_col DESC)。

KEEP必须配合聚合函数,不能单独用
直接写 col KEEP (DENSE_RANK LAST ORDER BY time_col) 会报 ORA-00937: not a single-group group function。KEEP 不是独立函数,它只是修饰符,必须挂载在 MAX、MIN、SUM 等聚合函数上。你真正要的是“最新时间对应那行的某个字段值”,而 KEEP 的作用就是让这个聚合函数只作用于排序后满足条件的子集。
常见错误写法:
-
SELECT dept_id, name KEEP (DENSE_RANK LAST ORDER BY hire_date) FROM emp GROUP BY dept_id—— 缺外层聚合函数 -
SELECT dept_id, MAX(name) KEEP (DENSE_RANK LAST ORDER BY hire_date DESC)——ORDER BY方向写反,LAST配DESC会取最早时间,不是最新
取“最新时间对应字段值”要配对使用 LAST + ASC 或 FIRST + DESC
DENSE_RANK LAST ORDER BY time_col 表示按 time_col 升序排后取最后一名(即最大/最新值);DENSE_RANK FIRST ORDER BY time_col DESC 是降序排后取第一名(也是最新)。二者逻辑等价,但可读性不同:业务语义明确时优先选 FIRST ORDER BY ... DESC。
例如查每个部门入职最晚员工的姓名:
SELECT dept_id,
MAX(ename) KEEP (DENSE_RANK FIRST ORDER BY hire_date DESC) AS latest_hire_name
FROM emp
GROUP BY dept_id;
注意:MAX(ename) 这里的 MAX 实际不参与比较,仅作为语法必需的“容器”——当多个人同一天入职时,它返回字母序最大的名字;若想返回字母序最小的,换用 MIN(ename) 即可。
ORDER BY 里不能写表达式或别名
KEEP 子句中的 ORDER BY 只接受原始列名或常量,不支持函数表达式(如 TO_DATE(date_str, 'YYYYMMDD'))、别名、甚至 LENGTH(col)。否则报 ORA-01747。
正确做法是提前把表达式算好:
- 用 CTE 提前计算:
WITH emp_ext AS (SELECT *, TO_DATE(hire_date_str, 'YYYY-MM-DD') hire_dt FROM emp),再在外部KEEP中引用hire_dt - 或建虚拟列(Oracle 11g+):
ALTER TABLE emp ADD hire_dt DATE GENERATED ALWAYS AS (TO_DATE(hire_date_str, 'YYYY-MM-DD')) VIRTUAL
错误示例:MAX(name) KEEP (DENSE_RANK FIRST ORDER BY TO_DATE(hire_date_str, 'YYYY-MM-DD') DESC) —— 直接报错。
并列时间值会导致多行结果被纳入聚合
如果两个员工同一天入职,DENSE_RANK FIRST ORDER BY hire_date DESC 会把两人同时选中,然后 MAX(name) 返回其中字典序最大者,MIN(name) 返回最小者。这符合设计,但容易被误认为“只取一行”。
若业务要求严格单行(哪怕并列也只随机/确定取一),不能依赖 DENSE_RANK,应改用:
-
ROW_NUMBER() OVER (PARTITION BY dept_id ORDER BY hire_date DESC, emp_id)+ 外层过滤WHERE rn = 1 - 或用
RANK替代DENSE_RANK,再结合ROWNUM = 1(需嵌套查询)
性能上,KEEP 和 ROW_NUMBER() 在 Oracle 中执行开销接近,差异主要在优化器是否能下推裁剪——但语义不同:KEEP 是“所有并列首行的聚合结果”,ROW_NUMBER() 是“强制编号后取第1个”。这点最容易忽略,也最难调试。


















