如何在SQL Server 2022中优化BULK INSERT性能

大芳君_1187

大芳君_1187

2026-10-09

946人浏览

原创

bulk insert在sql server 2022中仅当同时满足三个条件时才启用最小化日志:数据库恢复模式为bulk_logged或simple、目标表无活跃非聚集索引(含主键)、显式指定with(tablock)且无并发写入。

如何在sql server 2022中优化bulk insert性能

BULK INSERT 不是“写完就快”,它默认行为几乎总是慢的——必须显式配齐三个条件才能触发最小化日志,否则性能可能比多值 INSERT 还差。

必须同时满足的三个最小化日志前提

SQL Server 2022 的 BULK INSERT 只有在以下三者全部成立时,才会跳过完整日志记录、启用最小化日志(minimal logging):

  • 数据库恢复模式为 BULK_LOGGED 或 SIMPLE(不能是 FULL)
  • 目标表上无活跃的非聚集索引(主键/唯一约束自带的索引也算;可临时 DROP 或 DISABLE)
  • WITH (TABLOCK) 显式指定,且执行期间无其他并发写入者占用该表

漏掉任意一个,BULK INSERT 就退化成带锁的逐行日志路径,速度断崖下跌。别只改语句不改库——导入前必须跑:ALTER DATABASE yourdb SET RECOVERY BULK_LOGGED;导入完立刻切回 FULL 并做一次日志备份,否则后续日志无法截断。

TABLOCK 漏写或被忽略的典型表现

没加 TABLOCK 时,BULK INSERT 默认走行锁,尤其在目标表已有数据、且存在非空聚集索引时,极易触发锁升级为表锁,导致阻塞和超时。错误现象包括:

  • 执行卡住,sys.dm_exec_requests 中看到 wait_type = LCK_M_X 或 LCK_M_SCH_M
  • 同一张表并发执行多个 BULK INSERT 直接失败,报错 Cannot obtain a LOCK resource
  • 耗时随数据量非线性增长,10 万行比 5 万行慢 3 倍以上

正确写法必须带 TABLOCK,且放在 WITH 子句里:BULK INSERT orders FROM 'D:\data\orders.csv' WITH (FIELDTERMINATOR = ',', ROWTERMINATOR = '\n', TABLOCK)。别信“引擎会自动优化”的说法——它不会。

文件格式与字段解析的硬性限制

BULK INSERT 对源文件极其挑剔,类型不匹配或格式异常会导致整批失败,错误信息却只报 Cannot bulk load. The file ... could not be opened 或更模糊的 bulk load data conversion error,不指明哪一行哪一列。

  • 字段值含换行符、未转义双引号、NULL 字符时,FORMAT = 'CSV'(SQL Server 2017+)比手动设 FIELDTERMINATOR 更健壮,但必须加 FIRSTROW = 2 跳过表头
  • 源字段类型必须严格匹配目标列:CSV 里的 "123" 插 INT 列可以,但 "123.45" 插 INT 会整批失败
  • 含 NULL 的字段必须用 KEEPNULLS,否则默认填默认值或触发 NOT NULL 约束错误

建议先导出一小段样本数据,用 SELECT TOP 10 * FROM OPENROWSET(BULK ...) 预校验格式是否可解析。

ROWS_PER_BATCH 设多少才稳

这个参数控制每次提交的行数,直接影响内存占用、tempdb 压力和日志写入节奏。设太小(如 1000)事务开销大;设太大(如 100000)容易引发 tempdb 争抢或内存不足。

  • 实测在 SQL Server 2022 上,ROWS_PER_BATCH = 10000 是多数场景下的甜点值:兼顾吞吐与稳定性
  • 超过 50000 后,tempdb 的 allocation_bitmap 争抢明显上升,sys.dm_db_task_space_usage 中能看到大量等待
  • 如果目标表有计算列或触发器(不推荐),必须大幅调低,否则单批处理时间过长,易超时

别依赖默认值(0,即全当一批)。加上它:ROWS_PER_BATCH = 10000,是最小代价的稳态保障。

真正卡住性能的往往不是语句本身,而是恢复模式没切、索引没禁、TABLOCK 没写、文件字段隐式转换失败——这些点全得手动确认,SQL Server 不会替你兜底。

数码产品性能查询
数码产品性能查询

该软件包括了市面上所有手机CPU,手机跑分情况,电脑CPU,电脑产品信息等等,方便需要大家查阅数码产品最新情况,了解产品特性,能够进行对比选择最具性价比的商品。

下载

相关标签:

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
大数据分析工具有哪四个
大数据分析工具有哪四个

大数据分析的四个工具分别是rapidminer、Hpcc、Hadoop和Pentaho bi。大数据分析用于从各种来源生成的原始数据中提取有价值的数据。这些数据帮助我们获得有意义的见解、隐藏的模式、未知的相关性、市场趋势等等,具体取决于行业。大数据分析的主要动机是提供有价值的见解,以便为未来做出更好的决策。php中文网为大家带来了大数据分析的相关教程、以及相关文章等内容,供大家免费下载使用。

2023.06.21

4756

5

Java 大数据处理基础(Hadoop 方向)
Java 大数据处理基础(Hadoop 方向)

本专题聚焦 Java 在大数据离线处理场景中的核心应用,系统讲解 Hadoop 生态的基本原理、HDFS 文件系统操作、MapReduce 编程模型、作业优化策略以及常见数据处理流程。通过实际示例(如日志分析、批处理任务),帮助学习者掌握使用 Java 构建高效大数据处理程序的完整方法。

2025.12.08

1249

12

大数据专业学习教程
大数据专业学习教程

本专题整合了大数据专业学习相关教程,阅读专题下面的文章了解更多详细内容。

2026.01.05

223

5

python处理大数据合集
python处理大数据合集

本专题整合了python处理大数据相关教程,阅读专题下面的文章了解更多详细内容。

2026.01.05

466

22

sqlserver和mysql区别
sqlserver和mysql区别

SQL Server和MySQL是两种广泛使用的关系型数据库管理系统。它们具有相似的功能和用途,但在某些方面存在一些显著的区别。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

2023.08.11

5131

4

数据库三范式
数据库三范式

数据库三范式是一种设计规范,用于规范化关系型数据库中的数据结构,它通过消除冗余数据、提高数据库性能和数据一致性,提供了一种有效的数据库设计方法。本专题提供数据库三范式相关的文章、下载和课程。

2023.06.29

2545

3

如何删除数据库
如何删除数据库

删除数据库是指在MySQL中完全移除一个数据库及其所包含的所有数据和结构,作用包括:1、释放存储空间;2、确保数据的安全性;3、提高数据库的整体性能,加速查询和操作的执行速度。尽管删除数据库具有一些好处,但在执行任何删除操作之前,务必谨慎操作,并备份重要的数据。删除数据库将永久性地删除所有相关数据和结构,无法回滚。

2023.08.14

3801

10

vb怎么连接数据库
vb怎么连接数据库

在VB中,连接数据库通常使用ADO(ActiveX 数据对象)或 DAO(Data Access Objects)这两个技术来实现:1、引入ADO库;2、创建ADO连接对象;3、配置连接字符串;4、打开连接;5、执行SQL语句;6、处理查询结果;7、关闭连接即可。

2023.08.31

2771

3

MySQL恢复数据库
MySQL恢复数据库

MySQL恢复数据库的方法有使用物理备份恢复、使用逻辑备份恢复、使用二进制日志恢复和使用数据库复制进行恢复等。本专题为大家提供MySQL数据库相关的文章、下载、课程内容,供大家免费下载体验。

2023.09.05

907

5

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
热门推荐
/
最新课程
phpStudy极速入门视频教程
phpStudy极速入门视频教程

共6课时 | 54.6万人学习

独孤九贱(4)_PHP视频教程
独孤九贱(4)_PHP视频教程

共89课时 | 133.4万人学习