是,array_agg 默认会将 null 值纳入数组,生成如 [1, null, 3] 的结果,易导致 unnest 或 json 转换异常;推荐用 filter (where col is not null) 显式过滤或 coalesce 处理。

array_agg 会把 NULL 值也塞进数组里吗?
默认会。只要分组内某行的字段值是 NULL,它就会被包含在最终数组中,比如 ARRAY[1, NULL, 3]。这常导致后续处理出错,比如用 unnest() 或做 JSON 转换时抛异常。
- 加
FILTER (WHERE col IS NOT NULL)显式过滤:array_agg(col) FILTER (WHERE col IS NOT NULL) - 或者用
COALESCE(col, 'default')替换 NULL(注意类型需一致) - 聚合前加
WHERE col IS NOT NULL也可,但会整行过滤,慎用——可能误删其他非 NULL 字段的关联数据
排序不稳定?array_agg 不保证顺序
array_agg 默认不保证元素顺序,哪怕源表有 ORDER BY。实际执行计划可能因并行扫描、索引选择或 planner 优化而打乱顺序。
- 必须显式用
ORDER BY子句:array_agg(col ORDER BY col)或array_agg(col ORDER BY id DESC) - 排序表达式可以是任意合法字段或计算结果,但必须和
GROUP BY兼容(比如不能对未分组字段用非聚合函数) - 如果要按插入顺序排,且表有自增主键,就用
ORDER BY id最稳妥
聚合结果为空时返回 NULL 还是空数组?
当分组无匹配行时,array_agg 返回 NULL,不是 ARRAY[]::text[]。这对应用层判空很不友好,容易触发空指针或类型错误。
PostgreSQL 18.4 官方 Ubuntu 安装包现已发布,这是目前最新的稳定版本。推荐通过官方 APT 仓库安装:先执行 sudo apt update 更新索引,再运行 sudo apt install postgresql-18 即可完成部署。新版本引入了异步 I/O 子系统,在顺序扫描与 VACUUM 场景下性能提升显著,同时支持 UUID v7 原生生成函数与虚拟生成列。
- 用
COALESCE(array_agg(col), ARRAY[]::text[])强制转为空数组(注意类型需显式声明) - PostgreSQL 14+ 支持
ARRAY[]字面量,但旧版本必须写ARRAY[]::type[],比如ARRAY[]::integer[] - 若字段类型是
jsonb,空数组写法是ARRAY[]::jsonb[],别漏掉类型标注
大数据量下 array_agg 内存溢出怎么办?
当单个分组聚集几万行时,array_agg 可能吃光 work_mem,报错 ERROR: out of memory 或拖慢整个查询。
- 先确认是否真需要全量数组:有时只需前 N 个,改用
ARRAY(SELECT col FROM (...) LIMIT 10) - 调大
work_mem是临时解,但影响全局并发,不推荐长期依赖 - 考虑业务拆分:比如按时间窗口分段聚合,再由应用拼接;或改用物化视图预计算
- 避免在
SELECT *中滥用array_agg—— 它会让 planner 无法跳过无关列,加重 I/O
最麻烦的其实是嵌套聚合场景,比如 array_agg(ROW(id, name)),类型推导复杂、序列化开销大,上线前务必压测。










