在SQL中如何使用窗口函数将重叠的时间段合并为连续区间

雨丽姑娘_3650

雨丽姑娘_3650

2026-09-18

219人浏览

原创

重叠时间段合并是将有交集或紧邻的时间区间(如(1,5)、(4,8))压缩为不重叠的最小连续区间(如(1,8)),核心是按起始时间排序后,用lag()识别新区间起点,并通过累计求和分组,再取每组min(start_time)和max(end_time)。

在sql中如何使用窗口函数将重叠的时间段合并为连续区间

什么是“重叠时间段合并”的典型 SQL 场景

这个问题本质是把一组可能互相覆盖或紧邻的 [start_time, end_time] 区间,压缩成不重叠、不交叉的最小连续区间集合。比如原始数据有:(1, 5)(4, 8)(10, 12),期望结果是:(1, 8)(10, 12)。这不是简单去重,而是需要识别“当前行是否能接在上一个合并区间的尾巴后面”。

窗口函数在这里不可替代:必须按时间排序后逐行判断累积状态,而 LAG() 和运行累计逻辑(如 MAX() OVER (ORDER BY ... ROWS UNBOUNDED PRECEDING))是核心。

LAG() + 累计最大值标记新区间起点

关键思路是:对每行判断“它是否开始了一个新区间”——即它的 start_time 是否大于前一个已知合并区间的右边界。

Deep Agent
Deep Agent

一款AI办公效率工具,主要用于一站式人工智能决策解决方案平台,适合需要提升相关任务效率的用户。

下载
  • 先按 start_time 排序,用 LAG(end_time) OVER (ORDER BY start_time) 拿到上一行的 end_time
  • 定义“是否为新区间起点”:CASE WHEN start_time > LAG(end_time) OVER (ORDER BY start_time) THEN 1 ELSE 0 END
  • 对这个标志做累计求和:SUM(is_new_group) OVER (ORDER BY start_time),得到每个行所属的组号
  • 最后按组号分组,取每组的 MIN(start_time)MAX(end_time)

注意:首行的 LAG() 返回 NULL,需用 COALESCE(LAG(...), start_time - 1) 避免 start_time > NULL 判定为 TRUE(否则首行会错判为新组)。

PostgreSQL / MySQL 8.0+ / SQL Server 的写法差异点
  • PostgreSQL 和 SQL Server 支持 ROWS UNBOUNDED PRECEDING,累计逻辑稳定;MySQL 8.0+ 同样支持,但旧版不支持窗口函数,必须用变量模拟(不推荐)
  • 所有数据库中,ORDER BY 必须明确包含唯一键(如 id)防并列排序不确定性,否则同 start_time 的多行可能导致组号错乱
  • 如果存在 start_time = end_time 或负区间,需提前 WHERE start_time 过滤,否则 <code>MAX(end_time) 可能失真

示例片段(以 PostgreSQL 为例):

SELECT MIN(start_time) AS merged_start,
       MAX(end_time)   AS merged_end
FROM (
  SELECT start_time,
         end_time,
         SUM(is_new) OVER (ORDER BY start_time, id) AS grp
  FROM (
    SELECT start_time,
           end_time,
           id,
           CASE WHEN start_time > COALESCE(LAG(end_time) OVER (ORDER BY start_time, id), '-infinity'::timestamp)
                THEN 1 ELSE 0 END AS is_new
    FROM events
  ) t1
) t2
GROUP BY grp;

容易被忽略的边界情况
  • 时间类型精度不一致(如 datetime vs timestamp with time zone)会导致 LAG() 比较隐式转换失败或偏差
  • “紧邻区间”是否合并?例如 (1, 5)(5, 8):若需求要合并,条件得写成 start_time > LAG(end_time) → 不合并;start_time > LAG(end_time) + INTERVAL '1 second' → 合并,需按业务定义“重叠”语义
  • 空值处理:任何 start_timeend_timeNULL 会让整行退出合并逻辑,务必前置清洗
  • 性能:该方案需两次排序(子查询嵌套),大数据量时确保 (start_time, id) 有联合索引

真正卡住人的往往不是语法,而是没想清楚“什么算重叠”以及“第一行怎么安全初始化”。先跑通单字段数字区间,再套时间类型,比直接怼 timestamp 少踩一半坑。

相关专题

更多
数据分析工具有哪些
数据分析工具有哪些

数据分析工具有Excel、SQL、Python、R、Tableau、Power BI、SAS、SPSS和MATLAB等。详细介绍:1、Excel,具有强大的计算和数据处理功能;2、SQL,可以进行数据查询、过滤、排序、聚合等操作;3、Python,拥有丰富的数据分析库;4、R,拥有丰富的统计分析库和图形库;5、Tableau,提供了直观易用的用户界面等等。

2023.10.12

3663

8

SQL中distinct的用法
SQL中distinct的用法

SQL中distinct的语法是“SELECT DISTINCT column1, column2,...,FROM table_name;”。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2023.10.27

771

4

SQL中months_between使用方法
SQL中months_between使用方法

在SQL中,MONTHS_BETWEEN 是一个常见的函数,用于计算两个日期之间的月份差。想了解更多SQL的相关内容,可以阅读本专题下面的文章。

2024.02.23

949

5

SQL出现5120错误解决方法
SQL出现5120错误解决方法

SQL Server错误5120是由于没有足够的权限来访问或操作指定的数据库或文件引起的。想了解更多sql错误的相关内容,可以阅读本专题下面的文章。

2024.03.06

5421

10

sql procedure语法错误解决方法
sql procedure语法错误解决方法

sql procedure语法错误解决办法:1、仔细检查错误消息;2、检查语法规则;3、检查括号和引号;4、检查变量和参数;5、检查关键字和函数;6、逐步调试;7、参考文档和示例。想了解更多语法错误的相关内容,可以阅读本专题下面的文章。

2024.03.06

2423

4

oracle数据库运行sql方法
oracle数据库运行sql方法

运行sql步骤包括:打开sql plus工具并连接到数据库。在提示符下输入sql语句。按enter键运行该语句。查看结果,错误消息或退出sql plus。想了解更多oracle数据库的相关内容,可以阅读本专题下面的文章。

2024.04.07

5420

11

sql中where的含义
sql中where的含义

sql中where子句用于从表中过滤数据,它基于指定条件选择特定的行。想了解更多where的相关内容,可以阅读本专题下面的文章。

2024.04.29

7021

6

sql中删除表的语句是什么
sql中删除表的语句是什么

sql中用于删除表的语句是drop table。语法为drop table table_name;该语句将永久删除指定表的表和数据。想了解更多sql的相关内容,可以阅读本专题下面的文章。

2024.04.29

950

5

sql中删除一列的命令是什么
sql中删除一列的命令是什么

在sql中,使用alter table语句可以删除一列,语法为:alter table table_name drop column column_name。想了解更多sql的相关内容,可以阅读本专题下面的文章。

2024.04.29

832

5

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
热门推荐
/
最新课程
phpStudy极速入门视频教程
phpStudy极速入门视频教程

共6课时 | 54.6万人学习

独孤九贱(4)_PHP视频教程
独孤九贱(4)_PHP视频教程

共89课时 | 133万人学习