环比是与上一周期(如上月)比较,同比是与去年同期(如去年同月)比较;因业务时间不连续、分区复杂,lag()易错位,故用相关子查询配合日期函数精准锚定目标周期。

什么是环比和同比,为什么不能直接用窗口函数
环比是和上一个周期(比如上月、上周)比,同比是和去年同期(比如去年同月)比。SQL里没有现成的“自动找上月”或“自动找去年同月”的函数,LAG()这类窗口函数只能按排序顺序取前一行,但业务时间可能不连续(比如节假日没数据)、分区逻辑复杂(多维度分组),直接用LAG()容易错位或漏值。
嵌套子查询能显式控制时间条件,哪怕数据稀疏、日期不规则,也能精准锚定目标周期。
写环比子查询:必须用相关子查询匹配时间偏移
核心是让子查询“知道当前行的日期”,再用DATE_SUB()或ADD_MONTHS()算出上期时间点。不同数据库语法略有差异:
- MySQL:
(SELECT SUM(sales) FROM sales t2 WHERE t2.region = t1.region AND t2.month = DATE_SUB(t1.month, INTERVAL 1 MONTH)) - PostgreSQL:
(SELECT SUM(sales) FROM sales t2 WHERE t2.region = t1.region AND t2.month = t1.month - INTERVAL '1 month') - Oracle:
(SELECT SUM(sales) FROM sales t2 WHERE t2.region = t1.region AND t2.month = ADD_MONTHS(t1.month, -1))
注意:外层主表别名(如t1)必须在子查询中被引用,否则变成非相关子查询,结果会错乱;月份字段类型要是DATE或YEAR_MONTH,别用字符串拼接,否则2023-01减1会得2023-00这种非法值。
写同比子查询:小心跨年和闰年导致的日期不存在
同比要查“去年同月同日”,但2023-02-29在2022年不存在。直接用DATE_SUB(t1.date, INTERVAL 1 YEAR)在MySQL里会返回NULL,导致整个子查询结果为NULL。
稳妥做法是先提取年月,再构造目标日期:
(SELECT SUM(sales) FROM sales t2 WHERE t2.region = t1.region AND YEAR(t2.date) = YEAR(t1.date) - 1 AND MONTH(t2.date) = MONTH(t1.date))
这样即使某天没数据,只要当月有汇总值就能取到;如果必须按日粒度且要求严格对齐,得加COALESCE()兜底,比如用LAST_DAY(DATE_SUB(t1.date, INTERVAL 1 YEAR))取上月末最后一天。
性能和可读性怎么平衡
嵌套子查询每行都执行一次,数据量大时很慢。常见优化点:
- 确保子查询里的关联字段(如
region、month)都有联合索引,比如INDEX(region, month) - 避免在子查询里用
LIKE或函数包裹字段(如YEAR(date)),否则索引失效 - 如果只是看月度汇总,先用
GROUP BY region, YEAR(month), MONTH(month)聚合好再嵌套,别在原始明细表上跑
另外,别把环比、同比全塞进一个SELECT里写四层嵌套——人眼难读,优化器也难优化。拆成CTE更清晰:WITH monthly AS (SELECT region, month, SUM(sales) s FROM sales GROUP BY region, month),再从monthly里查环比同比。
最麻烦的是时区和业务日历(比如财年从4月开始),这时候子查询里的时间计算就得替换成自定义日历表JOIN,硬编码-1 YEAR基本不管用。










