答案是改用spout流式解析+分片写入+禁用日志组合策略。phpspreadsheet全量加载致百万行oom,spout内存恒定3~5mb;需安装box/spout:^4.0、启用php_zip、校验.xlsx格式;分片读取每1000行批量插入,关闭sql日志、临时禁用索引,并通过cli进程脱离web超时限制。

ThinkPHP导入Excel时遇到百万级数据卡死、内存溢出或超时,不是因为代码写错,而是默认用PHPExcel/PhpSpreadsheet全量加载表格进内存——10万行就可能吃光512MB内存,百万行直接触发OOM。必须绕过框架默认解析路径,改用流式读取+分片写入+禁用日志的组合策略。
放弃PhpSpreadsheet,改用Spout流式解析
PhpSpreadsheet会把整个.xlsx文件解压、解析、建DOM树再转数组,百万行内存占用轻松破2GB。Spout不加载整表,只按行流式解码,内存恒定在3~5MB。
执行命令安装:composer require box/spout:^4.0
确认php_zip扩展已启用(Spout依赖zip流解压),Windows用户需在php.ini中取消extension=zip前的分号。
关键点:Spout不支持.xls格式,上传时强制前端校验后缀为.xlsx或.csv,【否则解析失败且无明确报错】。
分片读取+批量插入,避免单次写入超时
第一步:用Spout打开上传文件,逐行读取,每1000行存入临时数组;
第二步:调用Db::name('user')->insertAll($batch)批量写入;
第三步:清空临时数组并调用gc_collect_cycles()释放引用;
第四步:每处理完10批次(即1万行),执行一次Db::execute('TRUNCATE TABLE `import_tmp_log`')清理中间日志表(如有);
注意:不要在循环内new模型实例,改用Db::raw()构造INSERT语句,避免ORM层额外开销。
关闭日志与事务优化
方法一:在导入开始前执行\think\facade\Db::listen(function() {}),彻底屏蔽SQL日志记录;
方法二:手动开启事务,但仅在每批次插入后commit,而非包裹全部百万行——否则事务日志暴涨拖慢InnoDB;
方法三:导入前临时禁用唯一索引和外键检查(MySQL):Db::execute('SET UNIQUE_CHECKS=0; SET FOREIGN_KEY_CHECKS=0;'),导入完成后再恢复。
【禁用索引期间严禁并发写入,否则数据一致性无法保障】
前端上传与后端分流控制
前端限制文件大小不超过200MB,用JavaScript切片上传(File API + Blob.slice),后端接收分片并合并为临时.xlsx文件;
后端收到完整文件后,立即生成唯一任务ID,将文件路径+任务ID写入Redis队列;
另起CLI进程消费队列:php think import:worker --task_id=xxx,该命令脱离Web请求生命周期,不受max_execution_time限制;
CLI进程内设置ini_set('memory_limit', '512M'),并用pcntl_fork()启动双worker并发解析——一个读Spout流,一个写数据库,通过管道通信同步进度。
php免费学习视频:立即使用
踏上前端学习之旅,开启通往精通之路!从前端基础到项目实战,循序渐进,一步一个脚印,迈向巅峰!











