postgresql 不支持 mode() 聚合函数,因官方至今未实现 sql:2016 标准中的该函数;需用窗口函数(如 row_number() + count())或子查询模拟,且须注意 null 处理与并列众数逻辑。

PostgreSQL 没有内置 MODE() 聚合函数 —— 你直接写 SELECT MODE() FROM ... 会报错 ERROR: function mode() does not exist。要实现分组众数(即每个分组中出现次数最多的值),必须用窗口函数或子查询组合模拟。
为什么不能直接用 MODE()?
PostgreSQL 官方直到 15 版本仍未提供标准 SQL 的 MODE() 聚合函数(尽管 SQL:2016 标准已定义)。部分教程提到的 MODE() WITHIN GROUP (ORDER BY ...) 是某些商业数据库(如 Oracle、SQL Server)的语法,在 PostgreSQL 中不识别,执行会直接失败。
常见错误现象:
ERROR: function mode(text) does not existERROR: syntax error at or near "within"- 误以为
pg_statistic或扩展能开箱即用 —— 实际上没有现成聚合接口
用 ROW_NUMBER() + COUNT() 窗口函数求众数
这是最通用、可读性好、支持多值并列(返回所有最高频项)的方法。核心思路:先按分组和值计数,再对每个分组内按频次降序排序,取序号为 1 的行。
示例:查每种 category 下销量最高的 product_name
SELECT DISTINCT
category,
FIRST_VALUE(product_name) OVER (
PARTITION BY category
ORDER BY COUNT(*) DESC, product_name
) AS mode_product
FROM sales
GROUP BY category, product_name;
说明:
PostgreSQL 18.4 官方 Ubuntu 安装包现已发布,这是目前最新的稳定版本。推荐通过官方 APT 仓库安装:先执行 sudo apt update 更新索引,再运行 sudo apt install postgresql-18 即可完成部署。新版本引入了异步 I/O 子系统,在顺序扫描与 VACUUM 场景下性能提升显著,同时支持 UUID v7 原生生成函数与虚拟生成列。
-
GROUP BY category, product_name先算出每个品类下每个商品的出现次数 -
COUNT(*) DESC确保最高频排第一;加product_name是为了在频次相同时稳定排序(避免 nondeterministic 结果) -
FIRST_VALUE()取每组第一个,DISTINCT去重避免重复输出同一category - 若需返回所有并列众数(不止一个),改用
RANK() OVER (...) = 1子查询更稳妥
用子查询 + LIMIT 1(仅适用单值众数场景)
当确认每个分组最多只有一个众数,且不关心并列情况时,可用更简洁的写法,但要注意 LIMIT 在子查询中必须配合 ORDER BY 和明确的 GROUP BY 上下文。
示例:
SELECT category, (SELECT product_name FROM sales s2 WHERE s2.category = s1.category GROUP BY product_name ORDER BY COUNT(*) DESC LIMIT 1) AS mode_product FROM (SELECT DISTINCT category FROM sales) s1;
注意点:
- 外层必须提供明确的分组键(如
s1.category),否则相关子查询无法关联 - 如果存在频次并列,
LIMIT 1只随机返回一个,结果不可控 - 性能随数据量增长明显变差 —— 每个分组都触发一次独立聚合扫描
用 MODE() WITHIN GROUP 的替代方案:升级到 v16+ 并启用 tablefunc?
不成立。截至 PostgreSQL 16(2023年发布),tablefunc 扩展仍不提供 MODE();社区也无主流第三方扩展填补该空白。有人尝试用 unnest(ARRAY_AGG()) 配合自定义聚合,但复杂度高、维护成本大,远不如窗口函数方案直接。
真正值得考虑的“替代”是接受现实:用 COUNT(*) + ROW_NUMBER() 就是当前最稳、最透明、最容易调试的方式。别在找“隐藏函数”上浪费时间 —— 它真的不存在。
容易被忽略的一点:众数在空值(NULL)参与统计时默认被排除。如果业务要求把 NULL 当作有效取值参与频次计算,必须显式写 GROUP BY product_name IS NULL, product_name 或先用 COALESCE() 替换,否则结果会静默丢失这部分统计。










