GROUPING()函数是唯一可靠方式,用于区分ROLLUP生成的汇总占位NULL(返回1)与原始数据中的真实NULL(返回0),其参数必须为GROUP BY列表中的列,且仅在含ROLLUP/CUBE/GROUPING SETS的查询中有效。

ROLLUP生成的NULL和真实NULL在结果中看起来一样,但含义不同
SQL标准里ROLLUP会在分组汇总行中填入NULL占位,比如对region和city做GROUP BY region, city WITH ROLLUP,最后几行的city为NULL,代表“该region下所有city的合计”,不是数据缺失。而真实NULL是原始表里本来就有的空值。两者在SELECT结果里无法靠值本身区分——都显示为NULL。
用GROUPING()函数识别ROLLUP生成的NULL
GROUPING()是专为此设计的标量函数,接受一个列名作为参数,返回1表示该列为ROLLUP(或CUBE/GROUPING SETS)生成的汇总占位NULL,返回0表示是真实数据中的NULL。它只在含ROLLUP等扩展分组的查询中有效,否则报错。
-
GROUPING(region)为1→ 这行是跨region汇总(即region列的NULL是ROLLUP生成的) -
GROUPING(city)为1→ 这行是跨city汇总(city列的NULL是ROLLUP生成的) - 两个都为
1→ 全局总计行 - 注意:
GROUPING()不能用于非GROUP BY子句中的列,也不能嵌套调用
实际查询中怎么写才不混淆
直接在SELECT里并列输出原列和对应GROUPING()值,再用CASE做语义化标注。例如:
SELECT CASE WHEN GROUPING(region) = 1 THEN 'ALL_REGIONS' ELSE region END AS region, CASE WHEN GROUPING(city) = 1 THEN 'ALL_CITIES' ELSE city END AS city, SUM(sales) AS total FROM sales_data GROUP BY region, city WITH ROLLUP;
这样既保留了原始结构,又让每行的NULL来源一目了然。别试图用IS NULL判断——它对两种NULL都返回TRUE,毫无区分度。
GROUPING_ID()适合多列组合判断
当有3列以上参与ROLLUP,比如GROUP BY a, b, c WITH ROLLUP,逐个写GROUPING(a)、GROUPING(b)、GROUPING(c)会很啰嗦。GROUPING_ID(a,b,c)把三列的GROUPING()结果按位拼成一个整数:比如GROUPING_ID(a,b,c)=3(二进制011)表示a是真实值(0),b和c是ROLLUP生成的NULL(1)。它本质是GROUPING(a)*4 + GROUPING(b)*2 + GROUPING(c)*1,顺序必须和GROUP BY一致。
容易漏掉的是:某些旧版MySQL(GROUPING(),得用HAVING加条件过滤或提前用COALESCE标记,但那不是真正区分,只是规避显示。

















