pgsql.cc 提供对 postgresql.org 官网内容的中文翻译,由 Pigsty 团队维护。
与大多数其他关系数据库产品一样, PostgreSQL支持 聚合函数。聚合函数从多行输入中计算出单个结果。 例如,有一些聚合函数可在一组行上计算count(计数)、 sum(和)、avg(平均值)、 max(最大值)和min(最小值)。
例如,我们可以用下面的语句找出所有记录中最低温度读数的最高值:
SELECT max(temp_lo) FROM weather;
max ----- 46 (1 row)
如果我们想知道这个读数出现在哪个(哪些)城市,我们可能会试试
SELECT city FROM weather WHERE temp_lo = max(temp_lo); 错误
但这行不通,因为聚合 max 不能用在 WHERE 子句中。(这个限制的存在是因为 WHERE 子句决定哪些行进入聚合阶段,所以它必须在聚合函数计算之前求值。)不过,正如常见的情况,可以把查询改写成另一种形式来达到想要的结果,这里用的是子选择:
SELECT city FROM weather
WHERE temp_lo = (SELECT max(temp_lo) FROM weather);
city
---------------
San Francisco
(1 row)
这样是可以的,因为子选择是一个独立的计算,它独立于外层选择所做的事情计算自己的聚合。
聚合与GROUP BY子句结合使用也很有用。例如,可以通过下面的查询,得到每个城市所观测到的最低温度的最大值:
SELECT city, max(temp_lo)
FROM weather
GROUP BY city;
city | max
---------------+-----
Hayward | 37
San Francisco | 46
(2 rows)
这会为每个城市输出一行。每个聚合结果都是针对与该城市匹配的表行计算的。这些分组行可以用以下子句过滤:HAVING:
SELECT city, max(temp_lo)
FROM weather
GROUP BY city
HAVING max(temp_lo) < 40;
city | max ---------+----- Hayward | 37 (1 row)
这样就只会为所有temp_lo值均小于 40 的城市返回相同的结果。最后,如果只关心名称以“S”开头的城市,可以这样做:
SELECT city, max(temp_lo)
FROM weather
WHERE city LIKE 'S%'
GROUP BY city
HAVING max(temp_lo) < 40;
理解聚合与 SQL 的 WHERE 和 HAVING 子句之间的交互很重要。 WHERE 与 HAVING 的根本区别在于:WHERE 在分组和聚合计算之前选择输入行(因此它控制哪些行进入聚合计算),而 HAVING 在分组和聚合计算之后选择分组行。因此, WHERE 子句不得包含聚合函数;试图用聚合来决定哪些行作为聚合的输入是没有意义的。另一方面, HAVING 子句总是包含聚合函数。 (严格说来,你也可以写不使用聚合的 HAVING 子句,但那是浪费:同样的条件放在 WHERE 阶段会更高效。)
注意,我们可以把城市名的限制条件放在 WHERE 中,因为它不需要聚合。这比把该限制加到 HAVING 更高效,因为我们避免了对所有未通过 WHERE 检查的行做分组和聚合计算。
译文有误、术语不当或页面显示问题,请到译文仓库 pgsty/pgdoc 报告译文问题。 英文原文本身的问题,请在当前版本的对应页面向上游反馈;上游不再修订已结束维护的版本。