SQL窗口函数COUNT OVER如何统计分组记录数

大丽同学_1331

大丽同学_1331

2026-08-24

754人浏览

原创

count(*) over(partition by user_id) 可为每行保留原始行数并统计用户关联记录总数,区别于group by;需避免漏写partition by、误用count(col)跳过null,且开窗函数执行早于外层order by。

sql窗口函数count over如何统计分组记录数

COUNT(*) OVER(PARTITION BY) 怎么写才不丢行

直接用 COUNT(*) OVER(PARTITION BY user_id) 就能为每行主表数据附上「该用户关联的从表记录总数」,且完全保留原始行数——这是它和 GROUP BY 最本质的区别。你不需要把所有字段塞进 GROUP BY,也不用担心 SELECT * 报错。

常见错误是漏掉 PARTITION BY 或写成 COUNT(col) 却没意识到它会跳过 NULL 值:

  • COUNT(*) 统计分区内的所有行(含 NULL)
  • COUNT(order_id) 只统计 order_id 非 NULL 的行——如果关联用的是 LEFT JOIN,且某用户无订单,order_id 为 NULL,那这行会被忽略,结果变成 0(这反而是你想要的,但得明确意图)
  • 别写 COUNT() OVER(PARTITION BY ...) —— 缺参数会报错

LEFT JOIN + COUNT OVER 和子查询哪个更快

在百万级订单表里查每个用户的订单数,COUNT(*) OVER(PARTITION BY customer_id) 通常比 (SELECT COUNT(*) FROM orders o2 WHERE o2.customer_id = u.id) 快 3–5 倍。执行计划里前者是一次全扫描 + 分区哈希聚合,后者是 N 次独立子查询,I/O 和 CPU 开销都高得多。

但要注意前提:从表必须提前过滤好。比如只统计「已支付订单」,不能靠主表 WHERE 带动,而要先用 CTE 或子查询筛出 paid_orders,再做 OVER

WITH paid_orders AS (
  SELECT customer_id FROM orders WHERE status = 'paid'
)
SELECT u.id, u.name, COUNT(po.customer_id) OVER(PARTITION BY u.id) AS paid_cnt
FROM users u
LEFT JOIN paid_orders po ON u.id = po.customer_id;

这里用 COUNT(po.customer_id) 而非 COUNT(*),是因为 LEFT JOIN 后没订单的用户对应 po.customer_id 是 NULL,COUNT() 自动跳过,结果为 0,语义准确。

Bg Eraser
Bg Eraser

一款利用AI清除图片背景和多余对象的在线图片处理工具,可帮助用户快速整理照片并获得更干净的视觉素材。

下载

统计占比时分母怎么取才不翻车

想算「每个订单状态占总订单数的百分比」,不能写 COUNT(*) / (SELECT COUNT(*) FROM orders)——子查询多扫一遍表,还容易在嵌套复杂时失效。正确姿势是用 COUNT(*) OVER() 作为分母:

SELECT status, COUNT(*) AS cnt,
       ROUND(COUNT(*) * 100.0 / COUNT(*) OVER(), 2) AS pct
FROM orders
GROUP BY status;

关键点:

  • COUNT(*) OVER() 不带 PARTITION BY,就是整张表总行数,稳定可靠
  • * 100.0 强制转浮点,避免 MySQL/PostgreSQL 整除截断(5/100 而不是 0.5
  • 如果要排除 NULL 状态再算占比,得改用 SUM(CASE WHEN status IS NOT NULL THEN 1 ELSE 0 END) OVER(),因为 COUNT(*) 本身无法跳过 NULL 行

ORDER BY 放在 OVER 里会发生什么

COUNT(*) OVER(PARTITION BY user_id ORDER BY create_time) 不是「按时间分组后计数」,而是「按时间排序后,从分区第一行累加到当前行」——也就是累积计数。你要的是每个用户的总订单数,就别加 ORDER BY;加了反而变慢,还容易误解结果。

只有当你真需要「截至当前时间的累计订单数」时才加 ORDER BY,比如看用户成长路径。但注意:ROWS BETWEEN UNBOUNDED PRECEDING AND CURRENT ROW 是默认框架,显式写出更稳妥,避免不同数据库默认行为差异。

真正容易被忽略的是:开窗函数在 SQL 执行顺序中晚于 WHEREJOIN,早于 ORDER BY。这意味着你不能靠外层 ORDER BY 控制 OVER 内部的计算顺序——必须在 OVER 子句里明确写。

相关专题

更多
数据分析工具有哪些
数据分析工具有哪些

数据分析工具有Excel、SQL、Python、R、Tableau、Power BI、SAS、SPSS和MATLAB等。详细介绍:1、Excel,具有强大的计算和数据处理功能;2、SQL,可以进行数据查询、过滤、排序、聚合等操作;3、Python,拥有丰富的数据分析库;4、R,拥有丰富的统计分析库和图形库;5、Tableau,提供了直观易用的用户界面等等。

2023.10.12

3723

8

SQL中distinct的用法
SQL中distinct的用法

SQL中distinct的语法是“SELECT DISTINCT column1, column2,...,FROM table_name;”。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2023.10.27

791

4

SQL中months_between使用方法
SQL中months_between使用方法

在SQL中,MONTHS_BETWEEN 是一个常见的函数,用于计算两个日期之间的月份差。想了解更多SQL的相关内容,可以阅读本专题下面的文章。

2024.02.23

969

5

SQL出现5120错误解决方法
SQL出现5120错误解决方法

SQL Server错误5120是由于没有足够的权限来访问或操作指定的数据库或文件引起的。想了解更多sql错误的相关内容,可以阅读本专题下面的文章。

2024.03.06

5501

10

sql procedure语法错误解决方法
sql procedure语法错误解决方法

sql procedure语法错误解决办法:1、仔细检查错误消息;2、检查语法规则;3、检查括号和引号;4、检查变量和参数;5、检查关键字和函数;6、逐步调试;7、参考文档和示例。想了解更多语法错误的相关内容,可以阅读本专题下面的文章。

2024.03.06

2503

4

oracle数据库运行sql方法
oracle数据库运行sql方法

运行sql步骤包括:打开sql plus工具并连接到数据库。在提示符下输入sql语句。按enter键运行该语句。查看结果,错误消息或退出sql plus。想了解更多oracle数据库的相关内容,可以阅读本专题下面的文章。

2024.04.07

5500

11

sql中where的含义
sql中where的含义

sql中where子句用于从表中过滤数据,它基于指定条件选择特定的行。想了解更多where的相关内容,可以阅读本专题下面的文章。

2024.04.29

7161

6

sql中删除表的语句是什么
sql中删除表的语句是什么

sql中用于删除表的语句是drop table。语法为drop table table_name;该语句将永久删除指定表的表和数据。想了解更多sql的相关内容,可以阅读本专题下面的文章。

2024.04.29

970

5

sql中删除一列的命令是什么
sql中删除一列的命令是什么

在sql中,使用alter table语句可以删除一列,语法为:alter table table_name drop column column_name。想了解更多sql的相关内容,可以阅读本专题下面的文章。

2024.04.29

852

5

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
热门推荐
/
最新课程
phpStudy极速入门视频教程
phpStudy极速入门视频教程

共6课时 | 54.6万人学习

独孤九贱(4)_PHP视频教程
独孤九贱(4)_PHP视频教程

共89课时 | 133.1万人学习