最快方式是数据库原生命令,但需严格匹配路径、权限、格式:MySQL用LOAD DATA INFILE并注意secure_file_priv;SQL Server用BULK INSERT并配置服务账户权限;PostgreSQL区分COPY(服务端)与\copy(客户端);SQLite .import无事务且不校验约束。

直接用数据库原生命令最快,但每种数据库的路径、权限、格式细节差异极大——选错方式轻则报错失败,重则静默丢数据。
MySQL 必须用 LOAD DATA INFILE,别碰 INSERT ... VALUES 大文件
百万行 CSV 用 INSERT 循环插入可能要几十分钟;LOAD DATA INFILE 通常几秒搞定。但它有硬性限制:
-
secure_file_priv路径必须匹配:先执行SHOW VARIABLES LIKE 'secure_file_priv';,把 CSV 拷到返回的那个目录里,否则报ERROR 1290 - 字段分隔符不是默认制表符:得显式写
FIELDS TERMINATED BY ',' - 带引号的字段要加
OPTIONALLY ENCLOSED BY '"',否则逗号会被误切 - 首行是标题?加
IGNORE 1 ROWS,不然第一行数据就变成字段名了 - 日期列格式不一致(比如 CSV 是
2024-03-15,表定义是DATETIME)会转成0000-00-00 00:00:00,建议先用SELECT验证解析结果
SQL Server 别依赖 SSMS 向导,BULK INSERT 才可控
SSMS 导入向导适合单次调试,批量导入多文件或自动化时容易卡在编码、换行、权限上。真正可靠的是 BULK INSERT:
Miller (mlr) 是一个命令行工具,用于查询、整形和重新格式化名称索引数据,如 CSV、TSV、JSON 和 JSON Lines。它将 awk、sed、cut、join 和 sort 的功能整合到一个专为结构化数据处理而构建的单一工具中。
- 服务账户必须有目标文件夹读取权限——不是你登录 Windows 的账户,而是 SQL Server 服务运行账户(查 SQL Server 配置管理器)
-
FIRSTROW = 2跳标题行,但注意 Windows 换行是\r\n,ROWTERMINATOR得设成'\r\n',否则最后一列可能粘连 - 中文乱码?在
WITH子句里加CODEPAGE = '65001'(UTF-8)或CODEPAGE = '936'(GBK) - 想导入整个文件夹?用
xp_DirTree查出所有.csv文件名,再拼BULK INSERT动态 SQL,但注意#temp表不能跨批执行,得在同一个会话里完成
PostgreSQL COPY 和 \copy 别混用
COPY 是服务器端命令,文件路径是数据库服务器上的绝对路径;\copy 是 psql 客户端元命令,路径是你本地机器的。选错就报 could not open file:
- 用
COPY前确认用户有pg_read_server_files角色,或直接用超级用户 - CSV 含换行或逗号?必须用双引号包裹字段,并声明
CSV HEADER QUOTE '"' DELIMITER ',' - 列顺序不匹配?显式指定目标列:
COPY t(col_a, col_b) FROM '/x.csv',否则按表定义顺序硬套 - 空字符串转
NULL?加NULL AS '',否则类型转换失败整行被拒(v15+ 可用ON ERROR CONTINUE)
SQLite .import 看似简单,但没事务、不校验、不触发约束
它只是把 CSV 当纯文本逐行喂给表,适合本地测试或一次性小数据。但这些坑常被忽略:
-
.mode csv必须提前设好,否则默认按空格切分 - 文件编码必须是 UTF-8,且不能有 BOM,否则第一列全乱码
- 遇到非法值(比如字符串往 INTEGER 插)直接跳过该行,无提示——得手动
SELECT核对行数是否一致 - 不走约束检查,主键冲突、NOT NULL 缺失都静默失败;也不触发
INSERT触发器 - 出错没法回滚,只能删表重来
最易被忽略的点:所有数据库的字段类型映射、空值处理、编码一致性,都得在导入前验证,而不是靠报错后反复试。尤其是日期、浮点、布尔字段,CSV 里看着一样,数据库里可能根本存不进去。

















