select into outfile 是最高效导出方式,但需 secure_file_priv 非 null 且有对应路径写权限;否则用 mysql 客户端管道流式导出,并注意字段转义、表头处理、分页查询与编码问题。

SELECT INTO OUTFILE 能用就优先用
只要 MySQL 服务端允许,SELECT INTO OUTFILE 是最高效、最可控的方式——它在服务端直接生成 CSV,不经过客户端中转,无内存压力,百万行也能秒级完成。
但前提是 secure_file_priv 非 NULL,且你有写入该路径的权限。执行前务必确认:
-
SHOW VARIABLES LIKE 'secure_file_priv';—— 返回空值或/var/lib/mysql-files/才能用;返回NULL表示彻底禁用,改配置重启也无效(云数据库如 RDS 基本都这样) - 路径必须是绝对路径,比如
/var/lib/mysql-files/export.csv,不能写./export.csv或~/export.csv - 导出后文件属主是
mysql用户,普通账户可能读不到,需额外sudo chown $USER:$USER /var/lib/mysql-files/export.csv - 字段含换行、逗号、双引号时,
OPTIONALLY ENCLOSED BY '"'必须带上,否则 CSV 解析会错位
典型语句:
SELECT id, name, phone, created_at FROM users WHERE status = 1 AND created_at > '2026-01-01' INTO OUTFILE '/var/lib/mysql-files/active_users.csv' FIELDS TERMINATED BY ',' OPTIONALLY ENCLOSED BY '"' LINES TERMINATED BY '\n';
secure_file_priv 为 NULL 时用 mysql 客户端管道流式导出
云环境或权限受限时,SELECT INTO OUTFILE 直接报错 The MySQL server is running with the --secure-file-priv option...,此时只能靠客户端本地处理。
核心思路:让 mysql 命令输出制表符分隔的文本,再用 awk 或 sed 转成带引号包裹的 CSV。不加载全量数据进内存,适合几十万行以下场景。
Miller (mlr) 是一个命令行工具,用于查询、整形和重新格式化名称索引数据,如 CSV、TSV、JSON 和 JSON Lines。它将 awk、sed、cut、join 和 sort 的功能整合到一个专为结构化数据处理而构建的单一工具中。
- 加
--batch --raw参数关闭美化格式(禁用列对齐、省略横线),避免干扰解析 - 字段含换行符时,
mysql默认会把换行转成\n字符串,awk无法还原——这种数据必须用SELECT INTO OUTFILE或编程语言处理 - Windows 下换行符建议用
\r\n,Linux/macOS 用\n,否则 Excel 打开可能单行显示 - 别用
-B(批处理模式),它会加边框和分隔线,后续清洗更麻烦
安全导出示例(Linux/macOS):
mysql -u root -p -h 10.1.2.3 -D mydb --batch --raw -e "SELECT id, name, email FROM users WHERE deleted = 0;" | \
awk 'BEGIN{FS="\t"; OFS=","} {for(i=1;i users.csv
导出带表头的 CSV 要手动拼接,MySQL 不原生支持
SELECT INTO OUTFILE 和 mysql 客户端默认都不输出列名。如果下游工具(如 Excel、Pandas)需要表头,得自己补。
- 用
UNION拼接表头风险高:第一行是字符串,其他行是实际数据类型,可能导致数值字段被强制转字符串,排序/计算异常 - 更稳妥的做法是分开生成:先用
SELECT COLUMN_NAME FROM INFORMATION_SCHEMA.COLUMNS WHERE TABLE_NAME='users' ORDER BY ORDINAL_POSITION拿列名,再导出数据,最后用cat headers.csv data.csv > final.csv - 如果用客户端管道方式,可在
awk前加一行echo '"id","name","email"' > users.csv,再追加数据
注意:INFORMATION_SCHEMA.COLUMNS 查询本身也受权限限制,某些账号看不到列元信息。
大数据量(百万级以上)导出必须分页或加 --quick
一次性查百万行再导出,容易触发客户端内存溢出或超时。即使 SELECT INTO OUTFILE 在服务端执行,若查询本身没索引、没 LIMIT,也可能拖慢线上库。
- 加
--quick参数(即-q)让mysql客户端逐行读取,不缓存整结果集,配合管道使用很关键 - 服务端导出时,确保
WHERE条件有索引,避免全表扫描;必要时按主键分段导出:WHERE id BETWEEN 1 AND 100000、id BETWEEN 100001 AND 200000… - 别用
SELECT *导出大宽表,只选真正需要的字段,减少网络传输和磁盘 IO - 导出过程中禁止对源表做 DDL(如 ALTER TABLE),否则可能阻塞或失败
最终生成的 CSV 文件编码默认是数据库连接字符集(通常是 utf8mb4),用 Excel 打开中文乱码?不是导出问题,是 Excel 没识别 UTF-8 BOM —— 用 VS Code 或 Notepad++ 确认编码,或导出后用 iconv -f utf8mb4 -t gbk users.csv > users_gbk.csv 转码。










