“添加多个文件”只是串行执行导入向导,不会自动对齐字段、去重或追加写入;所有CSV必须列数相同、字段顺序一致、编码统一(推荐UTF-8 with BOM),否则报错;字段映射仅依据第一个CSV列头,后续文件按位置硬套;真正可控的批量导入需分步手动操作并启用追加模式。
“添加多个文件”不是合并导入,只是串行执行
navicat 导入向导里的「添加多个文件」按钮,**不会自动对齐字段、去重或追加写入**。它本质是把每个 csv 当作独立任务,依次执行 insert into ... select 或临时表插入。结果取决于你是否提前处理好一致性:
- 所有 CSV 必须列数相同、字段顺序一致、编码统一(推荐 UTF-8 with BOM)
- 若某 CSV 缺少一列,会报错
Column count doesn't match value count - 目标表有主键时,第二个 CSV 中重复主键会触发
Duplicate entry,除非你手动勾选「忽略重复记录」 - 字段映射只认第一个 CSV 的列头——后面文件的列名不同也没用,全按位置硬套
真正可控的批量导入:分步手动 + 追加模式
想确保数据不丢、不错、不覆盖,就得放弃“一键多文件”的幻想,分三步操作:
- 先用 VS Code 或 Notepad++ 打开所有 CSV,确认首行是纯字段名(无空格、无引号、无 BOM 异常),且每列语义对齐(比如都叫
user_id,不是有的叫id有的叫uid) - 右键目标表 → 「导入向导」→ 选第一个 CSV → 到「字段映射」页 → 点开「高级」→ 勾选「跳过第一行(如果存在标题)」
- 导入完第一个后,对剩下每个 CSV 单独走一遍向导,但在「高级」里把导入模式设为「追加」,并根据业务选「忽略重复」或「更新匹配行」
注意:追加 模式只在目标表已有数据时生效;误选「清空后导入」会直接删掉前面导好的数据。
大数量或高频场景:用脚本合并再单次导入
超过 10 个 CSV 或经常要批量导入,图形界面逐个点太慢,推荐预合并:
Miller (mlr) 是一个命令行工具,用于查询、整形和重新格式化名称索引数据,如 CSV、TSV、JSON 和 JSON Lines。它将 awk、sed、cut、join 和 sort 的功能整合到一个专为结构化数据处理而构建的单一工具中。
- Linux/macOS:用
tail -n +2 *.csv > merged.csv跳过各文件首行,再手动补一行统一字段名 - Windows:PowerShell 用
Get-Content *.csv | Select-Object -Skip 1 | Set-Content merged.csv,然后用文本编辑器加回标题行 - 合并后检查空值表示——所有 CSV 里表示 NULL 的必须统一为
\N,并在 Navicat 「高级」里填入「NULL值表示为」\N - 最后只用 Navicat 导一次
merged.csv,字段映射、编码、日期格式都能集中调优
容易被忽略的底层细节
即使 CSV 看起来格式整齐,这些点不处理,导入照样失败:
-
LOAD DATA INFILE模式虽快,但要求 MySQL 服务端开启local_infile=ON,且路径必须是服务端可读的(不是你本地路径) - 中文乱码往往不是编码选错,而是 Navicat 连接参数里
character_set_client没设成utf8mb4 - 日期字段在 CSV 里是
2025-03-15,但 Navicat 默认不识别,得在「字段映射」页单独点开该列 → 「格式」里选yyyy-MM-dd - 大文件(>10MB)别依赖默认
INSERT,进「高级」调高「提交记录数」到 5000,并关掉「启用外键检查」
字段对齐、空值约定、服务端配置——这三个层面任何一个没对齐,批量导入就变成批量报错。










