Golang怎么实现导入CSV数据_Golang如何解析CSV文件导入到数据库【实战】

大强大大_9812

大强大大_9812

2026-03-24

431人浏览

原创

csv读取中文乱码需先用golang.org/x/text/encoding解码原始字节流再交csv.newreader;sqlx.in批量插入应分批(如每批1000行)并用sqlx.rebind适配方言;struct应物理隔离csvrow和dbrecord并手动转换;大文件导入须逐行读、限并发、分事务提交。

golang怎么实现导入csv数据_golang如何解析csv文件导入到数据库【实战】

csv.NewReader 读取文件时中文乱码怎么办

Go 标准库 csv.NewReader 默认按 UTF-8 解析,如果 CSV 文件是 GBK、GB2312 或其他编码(比如 Excel 直接另存为的 CSV),会直接读出乱码甚至报 invalid UTF-8 错误。

解决方法不是“转码后喂给 csv.NewReader”,而是先用 golang.org/x/text/encoding 解包原始字节流,再把解码后的 []byte 交给 csv.NewReader:

  • 先用 encoding/gbk.NewDecoder().Bytes() 或 encoding/GBK.DecodeString() 转换原始内容(注意:不能直接对 *os.File 做 decode,必须读全再转)
  • 避免边读边解码——csv.Reader 内部有缓冲和行切分逻辑,提前 decode 整个文件更可控
  • Windows 上用 Excel 保存的 CSV 很可能带 BOM,utf8.BOM 开头会被当普通字符读入第一列,建议用 bytes.TrimPrefix(data, []byte("\xef\xbb\xbf")) 清理

sqlx.In 配合批量插入时 placeholder 数量超限怎么处理

PostgreSQL 和 MySQL 对单条 SQL 的参数数量有限制(MySQL 默认 65535,但实际受 max_allowed_packet 影响;PostgreSQL 则在 prepare 阶段就报错 too many parameters)。用 sqlx.In 拼 INSERT INTO ... VALUES (?, ?), (?, ?), ... 时,很容易撞上这个墙。

核心思路是「分批」,但别手动拆 slice——sqlx.In 返回的是 query string 和 args []interface{},你需要自己控制每批最多多少组值:

  • 按每批 1000 行(或根据字段数反推参数总数 ≤ 5000)切分原始数据 slice
  • 对每批调用一次 sqlx.In,再用 sqlx.Rebind 绑定方言(如 postgres 要转成 $1, $2)
  • 不要把所有 args 合并后一次性传给 db.Exec,那是越界根源

struct tag 里 csv 和 db 标签冲突怎么协调

一个结构体既要被 csvutil.Unmarshal(或手写映射)解析 CSV 行,又要被 sqlx.StructScan 映射数据库查询结果,两边 tag 名都叫 csv 和 db,但字段顺序、空值处理、类型转换逻辑常常不一致。

Golang Samber Hot
Golang Samber Hot

在 Golang 中使用 samber/hot 进行内存缓存,支持 LRU、LFU、TinyLFU、W‑TinyLFU、S3FIFO、ARC、TwoQueue、SIEVE、FIFO 等淘汰算法,提供 TTL、缓存加载器及分片功能。

下载

最省事的做法是「物理隔离」:不用同一 struct 承担两种职责:

  • 定义 CSVRow struct,只带 csv tag,用于解析原始 CSV 行(字段类型尽量用 string 或 *string,避开解析失败)
  • 定义 DBRecord struct,只带 db tag,用于插入或查询
  • 写一个轻量转换函数,比如 func (r *CSVRow) ToDB() *DBRecord,在里面做非空校验、时间格式 parse、默认值填充等业务逻辑
  • 别依赖反射自动转换——CSV 字段缺失时 csv.Read 会跳过该字段,但 struct 字段若没对应 tag 就永远收不到值,静默丢数据

大文件导入时内存暴涨、goroutine 泄漏怎么压住

用 csv.NewReader(file) + ReadAll() 读几 MB 的 CSV 看不出问题,但一旦到 100MB+,ReadAll 会把整张表加载进内存,GC 压力大,还可能 OOM;如果改成 for record := range reader.Read() 却忘了控制并发,起一堆 goroutine 跑 db.Exec,又容易打爆数据库连接池。

关键约束点就两个:内存上限、并发度:

  • 永远用 reader.Read() 逐行读,配合 sync.Pool 复用 []string 切片(避免高频 alloc)
  • 用 semaphore(比如 golang.org/x/sync/semaphore)控并发,比如设 Weight: 1,最大 5 个 goroutine 同时写 DB
  • 每 1000 行 commit 一次事务(tx.Commit()),别等全部读完再 commit——否则事务太长锁表,且失败时回滚代价高

真正难的不是读或写,是 CSV 字段里混着换行符(\n)、引号、逗号,而 csv.Reader 默认能处理,但你若提前按 \n 切行再喂给它,就彻底毁了格式。这事得信标准库,别自己 split。

golang免费学习笔记(深入):立即使用
在学习笔记中,你将探索golang的核心概念和高级技巧!

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

golang

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
C语言变量命名
C语言变量命名

c语言变量名规则是:1、变量名以英文字母开头;2、变量名中的字母是区分大小写的;3、变量名不能是关键字;4、变量名中不能包含空格、标点符号和类型说明符。php中文网还提供c语言变量的相关下载、相关课程等内容,供大家免费下载使用。

2023.06.20

2789

3

c语言入门自学零基础
c语言入门自学零基础

C语言是当代人学习及生活中的必备基础知识,应用十分广泛,本专题为大家c语言入门自学零基础的相关文章,以及相关课程,感兴趣的朋友千万不要错过了。

2023.07.25

2168

9

c语言运算符的优先级顺序
c语言运算符的优先级顺序

c语言运算符的优先级顺序是括号运算符 > 一元运算符 > 算术运算符 > 移位运算符 > 关系运算符 > 位运算符 > 逻辑运算符 > 赋值运算符 > 逗号运算符。本专题为大家提供c语言运算符相关的各种文章、以及下载和课程。

2023.08.02

1140

5

c语言数据结构
c语言数据结构

数据结构是指将数据按照一定的方式组织和存储的方法。它是计算机科学中的重要概念,用来描述和解决实际问题中的数据组织和处理问题。数据结构可以分为线性结构和非线性结构。线性结构包括数组、链表、堆栈和队列等,而非线性结构包括树和图等。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

2023.08.09

1078

4

c语言random函数用法
c语言random函数用法

c语言random函数用法:1、random.random,随机生成(0,1)之间的浮点数;2、random.randint,随机生成在范围之内的整数,两个参数分别表示上限和下限;3、random.randrange,在指定范围内,按指定基数递增的集合中获得一个随机数;4、random.choice,从序列中随机抽选一个数;5、random.shuffle,随机排序。

2023.09.05

1296

5

c语言const用法
c语言const用法

const是关键字,可以用于声明常量、函数参数中的const修饰符、const修饰函数返回值、const修饰指针。详细介绍:1、声明常量,const关键字可用于声明常量,常量的值在程序运行期间不可修改,常量可以是基本数据类型,如整数、浮点数、字符等,也可是自定义的数据类型;2、函数参数中的const修饰符,const关键字可用于函数的参数中,表示该参数在函数内部不可修改等等。

2023.09.20

1998

7

c语言get函数的用法
c语言get函数的用法

get函数是一个用于从输入流中获取字符的函数。可以从键盘、文件或其他输入设备中读取字符,并将其存储在指定的变量中。本文介绍了get函数的用法以及一些相关的注意事项。希望这篇文章能够帮助你更好地理解和使用get函数 。

2023.09.20

3100

8

c数组初始化的方法
c数组初始化的方法

c语言数组初始化的方法有直接赋值法、不完全初始化法、省略数组长度法和二维数组初始化法。详细介绍:1、直接赋值法,这种方法可以直接将数组的值进行初始化;2、不完全初始化法,。这种方法可以在一定程度上节省内存空间;3、省略数组长度法,这种方法可以让编译器自动计算数组的长度;4、二维数组初始化法等等。

2023.09.22

13615

6

c语言中null和NULL的区别
c语言中null和NULL的区别

c语言中null和NULL的区别是:null是C语言中的一个宏定义,通常用来表示一个空指针,可以用于初始化指针变量,或者在条件语句中判断指针是否为空;NULL是C语言中的一个预定义常量,通常用来表示一个空值,用于表示一个空的指针、空的指针数组或者空的结构体指针。

2023.09.22

529

3

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程