This commit is contained in:
toom1996
2026-09-21 19:19:03 +08:00
parent dffcf9f9e5
commit 299fd974df
11 changed files with 3392 additions and 575 deletions

View File

@ -1,28 +1,38 @@
// Command dbtool 是后台管理用的数据库搬运脚本。
// Command dbtool 是后台管理用的数据库导出脚本。
//
// 用途:在不同开发电脑 / 环境之间搬运 PostgreSQL 库(fashion)的「数据」,
// 省去手动 pg_dump / 重新 seed 的麻烦。完全复用后端既有的 pgx 驱动与
// configs/config.yml,不依赖任何外部二进制(pg_dump 等)。
// 用途:把一个 PostgreSQL 库(fashion)的「结构 + 索引 + 约束 + 数据」导出为
// **单个纯 SQL 文件**,拷到另一台机器后直接用 psql 灌入即可 —— 无需 pg_dump。
//
// 子命令:
// dbtool dump [-config <yml>] [-out <file.sql>] [-with-extension]
//
// dbtool dump -out db_dump.json 导出当前库全部表的数据 + 列元信息为单个 JSON 文件
// dbtool import -in db_dump.json 把 JSON 数据灌入目标库(结构先由 AutoMigrate 收敛)
// 导入方式(目标机器):
//
// 结构在哪里定义:**只在代码里** —— model 的 GORM tag + database.EnsureDedupSchema。
// import 会先调 database.AutoMigrate + EnsureDedupSchema,把目标库收敛到与当前代码
// 一致(建表 / 加列 / 加索引 / 建 pgvector 扩展 / 建 HNSW 索引),然后再灌数据。
// psql -U fashion -d fashion -v ON_ERROR_STOP=1 -f db_dump.sql
//
// 历史实现曾让 import 自己读 information_schema 拼 DDL 来重建表,那条路必然丢信息
// (类型修饰符 vector(64)、identity 自增、索引、扩展),已移除。
// 结构从哪来:**唯一入口就是本工具的 dump 输出**。项目已不再在服务启动时自动迁移表结构
// (原 database.AutoMigrate / EnsureDedupSchema 已移除),重建一个库就是「dump 出来再灌进去」。
//
// 为什么没有 import 子命令:数据段用的是 SQL 标准的 COPY ... FROM stdin,它依赖 PostgreSQL
// 前端的 copy 子协议,Go 的 database/sql 无法执行这类脚本。导入统一交给 psql。
//
// 与 pg_dump 的关系:本工具不依赖任何外部二进制,等于把「读系统目录 → 拼 DDL → 导数据」
// 自己实现一遍,因此**只覆盖本项目实际用到的对象**:
//
// 表、列(类型含修饰符 / 默认值 / identity / NOT NULL)、主键、索引(含 pgvector 的 HNSW)、
// 数据(COPY)、序列当前值。
//
// 视图 / 触发器 / 外键 / 注释 / 权限不导出(当前库中也不存在)。
//
// 前置条件:目标库必须已启用 pgvector 扩展,否则 vector(64) 列建不出来。
// 默认**不**导出扩展语句(可用 -with-extension 带上)。若目标容器由 scripts/pgvector 的
// compose 启动,initdb/01-extensions.sql 会在数据卷首次初始化时自动创建扩展。
//
// 连接信息来自 configs/config.yml 的 database 段(同后端服务),可用 -config 指定其它配置。
package main
import (
"bufio"
"database/sql"
"encoding/json"
"errors"
"flag"
"fmt"
"log"
@ -30,70 +40,31 @@ import (
"strings"
"time"
"github.com/jackc/pgx/v5/pgconn"
_ "github.com/jackc/pgx/v5/stdlib"
"gorm.io/driver/postgres"
"gorm.io/gorm"
"gorm.io/gorm/logger"
"fashionapi/internal/config"
"fashionapi/internal/database"
)
// columnMeta 是单列的元信息,用于导入时的类型转换与 identity 判定。
type columnMeta struct {
Name string `json:"name"`
// Type 为 udt_name,如 int8 / varchar / timestamptz / vector。
// 注意:它**不含**类型修饰符(vector(64) 会退化成 vector),
// 因此不可用于重建 DDL —— 结构一律交给 database.AutoMigrate。
Type string `json:"type"`
IsNullable bool `json:"is_nullable"`
// IsIdentity 取 information_schema.columns.is_identity。
// 必须读这一列:identity 列的 column_default 是 NULL,
// 用 column_default LIKE 'nextval(%' 去猜会把它全部漏判为「非自增」,
// 于是重建出的表 id 没有默认值、插入即违反 NOT NULL。
IsIdentity bool `json:"is_identity"`
Default string `json:"default,omitempty"`
}
// tableDump 是单张表的导出结构。
type tableDump struct {
Name string `json:"name"`
Columns []columnMeta `json:"columns"`
Pk []string `json:"pk"`
Rows [][]any `json:"rows"` // 每行为一组值;nil 表示 NULL,string 表示值
}
// dumpFile 是 dump 输出的顶层结构。
type dumpFile struct {
Version int `json:"version"`
GeneratedAt string `json:"generated_at"`
Database string `json:"database"`
Tables []tableDump `json:"tables"`
}
// verbose 控制是否打印每条执行的 SQL(用于排查)。由 dump/import 子命令的 -v 开关设置。
var verbose bool
// vlog 在开启 verbose 时打印调试信息。
func vlog(format string, args ...any) {
if verbose {
log.Printf("[sql] "+format, args...)
}
}
// pgDetail 提取 PostgreSQL 报错的位置/消息,便于定位语法错误。
func pgDetail(err error) string {
var pgErr *pgconn.PgError
if errors.As(err, &pgErr) {
return fmt.Sprintf(" [position=%d message=%q where=%q]", pgErr.Position, pgErr.Message, pgErr.Where)
}
return ""
}
// quoteLit 安全包裹 SQL 字符串字面量(转义单引号),用于内联可信的内部标识符/表名。
func quoteLit(s string) string {
return "'" + strings.ReplaceAll(s, "'", "''") + "'"
// column 是单列的结构信息,用于生成 CREATE TABLE、COPY 列清单与序列重置语句。
type column struct {
Name string
// Type 为 format_type(atttypid, atttypmod) 的结果,**含**类型修饰符:
// vector(64) / character varying(255) / bigint。
// 不能用 information_schema.udt_name —— 它会丢掉修饰符(vector(64) 变成 vector),
// 建出来的列没有维度,随后 HNSW 索引会报 "column does not have dimensions"。
Type string
// NotNull 取自 pg_attribute.attnotnull。
NotNull bool
// Default 取自 pg_get_expr(adbin, adrelid),如 0 / ''::character varying / nextval('x'::regclass)。
Default string
// Identity 取自 pg_attribute.attidentity:'d'=BY DEFAULT、'a'=ALWAYS、''=非 identity。
Identity string
// AutoIncrement 表示该列由序列自动赋值(identity 列,或默认值是 nextval 的 serial 列),
// 导出后会追加 setval 把序列推到 MAX(col)+1。
//
// 判定必须读 attidentity:identity 列的 column_default 是 NULL,
// 用 column_default LIKE 'nextval(%' 去猜会把它们全部漏判,重建出的表 id 就没有自增。
AutoIncrement bool
}
func main() {
@ -104,8 +75,6 @@ func main() {
switch os.Args[1] {
case "dump":
runDump(os.Args[2:])
case "import":
runImport(os.Args[2:])
default:
usage()
os.Exit(2)
@ -113,16 +82,20 @@ func main() {
}
func usage() {
fmt.Println(`dbtool - 后台数据库搬运脚本(PostgreSQL)
fmt.Println(`dbtool - 后台数据库导出脚本(PostgreSQL)
用法:
dbtool dump [-config <yml>] [-out <file>] 导出全库数据到 JSON
dbtool import [-config <yml>] [-in <file>] 把 JSON 数据灌入目标库
dbtool dump [-config <yml>] [-out <file>] [-with-extension]
导出「结构 + 主键 / 索引 + 数据」为单个纯 SQL 文件
导入(目标机器):
psql -U fashion -d fashion -v ON_ERROR_STOP=1 -f <file>
说明:
连接信息读取 configs/config.yml 的 database 段(可用 -config 覆盖)。
import 会先把目标库结构收敛到与当前代码一致(AutoMigrate + EnsureDedupSchema),
再清空同名表并按 JSON 重灌数据。结构定义只在代码里,dump 文件不含 DDL。`)
-with-extension 会在文件开头加 CREATE EXTENSION IF NOT EXISTS vector;
默认不加,此时目标库须已启用 pgvector,否则 vector 列建不出来。
目标库必须是**空库**(脚本按 CREATE TABLE IF NOT EXISTS + COPY 写入,不会清表)。`)
}
// openDB 按 config 加载 DSN 并探活。
@ -142,14 +115,16 @@ func openDB(cfgPath string) (*sql.DB, *config.DatabaseConfig, error) {
return db, &cfg.Database, nil
}
// runDump 导出全库。
// runDump 导出「结构 → 数据 → 主键/索引 → 序列」四段到单个 SQL 文件。
//
// 段落顺序刻意与 pg_dump 一致:先建表、再灌数据、最后建约束与索引。
// 索引放在数据之后建,既快又不会在导入过程中被反复维护。
func runDump(args []string) {
fs := flag.NewFlagSet("dump", flag.ExitOnError)
out := fs.String("out", "db_dump.json", "导出文件路径")
out := fs.String("out", "db_dump.sql", "导出文件路径")
cfgPath := fs.String("config", "", "配置文件路径(默认 configs/config.yml)")
v := fs.Bool("v", false, "打印每条执行的 SQL,便于排查")
withExt := fs.Bool("with-extension", false, "在文件开头加 CREATE EXTENSION IF NOT EXISTS vector")
_ = fs.Parse(args)
verbose = *v
db, dcfg, err := openDB(*cfgPath)
if err != nil {
@ -157,127 +132,103 @@ func runDump(args []string) {
}
defer db.Close()
f, err := os.Create(*out)
if err != nil {
log.Fatalf("✗ 创建文件 %s 失败: %v", *out, err)
}
defer f.Close()
w := bufio.NewWriter(f)
writeHeader(w, dcfg)
if *withExt {
fmt.Fprintln(w, "CREATE EXTENSION IF NOT EXISTS vector;")
fmt.Fprintln(w)
}
tables, err := listTables(db)
if err != nil {
log.Fatalf("✗ 列举表失败: %v", err)
}
df := dumpFile{
Version: 1,
GeneratedAt: time.Now().UTC().Format(time.RFC3339),
Database: dcfg.Name,
Tables: make([]tableDump, 0, len(tables)),
if len(tables) == 0 {
log.Fatalf("✗ 库中没有表(schema=public),请确认 -config 指向的库是否正确")
}
cols := make(map[string][]column, len(tables))
// ① 结构
fmt.Fprintln(w, "-- ==================== 结构 ====================")
for _, t := range tables {
log.Printf("→ 导出表 %s ...", t)
td, err := dumpTable(db, t)
cs, err := listColumns(db, t)
if err != nil {
log.Fatalf("✗ 导出表 %s 失败: %v", t, err)
log.Fatalf("✗ 读取 %s 的列失败: %v", t, err)
}
df.Tables = append(df.Tables, td)
cols[t] = cs
writeCreateTable(w, t, cs)
}
log.Printf("→ 结构:%d 张表", len(tables))
// ② 数据
fmt.Fprintln(w, "-- ==================== 数据 ====================")
var total int64
for _, t := range tables {
n, err := writeCopyData(w, db, t, cols[t])
if err != nil {
log.Fatalf("✗ 导出 %s 数据失败: %v", t, err)
}
total += n
log.Printf(" ✓ %s: %d 行", t, n)
}
data, err := json.MarshalIndent(df, "", " ")
if err != nil {
log.Fatalf("✗ 序列化失败: %v", err)
// ③ 主键 / 索引
fmt.Fprintln(w, "-- ==================== 主键 / 索引 ====================")
for _, t := range tables {
if err := writeConstraints(w, db, t); err != nil {
log.Fatalf("✗ 导出 %s 约束失败: %v", t, err)
}
if err := writeIndexes(w, db, t); err != nil {
log.Fatalf("✗ 导出 %s 索引失败: %v", t, err)
}
}
if err := os.WriteFile(*out, data, 0o644); err != nil {
// ④ 序列当前值:COPY 写了显式 id,不会推进序列,必须手工推到 MAX+1。
fmt.Fprintln(w, "-- ==================== 序列当前值 ====================")
for _, t := range tables {
writeSequenceResets(w, t, cols[t])
}
if err := w.Flush(); err != nil {
log.Fatalf("✗ 写文件 %s 失败: %v", *out, err)
}
log.Printf("✓ 已导出 %d 张表 -> %s", len(df.Tables), *out)
log.Printf("✓ 已导出 %d 张表、%d 行 -> %s", len(tables), total, *out)
}
// runImport 把 JSON 中的数据灌入目标库。
//
// 结构不在这里重建:先调 ensureSchema 用后端的 AutoMigrate + EnsureDedupSchema
// 把目标库收敛到与当前代码一致(建表 / 加列 / 加索引 / 建 pgvector 扩展 / 建 HNSW 索引),
// 本函数只负责搬数据。这样结构只有一个来源(model + EnsureDedupSchema),
// 不会再出现「自拼 DDL 丢类型修饰符 / 丢 identity 自增 / 丢索引 / 不建扩展」那一类问题。
//
// 注意:导入先清空目标同名表再写入,属「以 dump 为准的整体覆盖」。
func runImport(args []string) {
fs := flag.NewFlagSet("import", flag.ExitOnError)
in := fs.String("in", "db_dump.json", "导入文件路径")
cfgPath := fs.String("config", "", "配置文件路径(默认 configs/config.yml)")
_ = fs.Parse(args)
raw, err := os.ReadFile(*in)
if err != nil {
log.Fatalf("✗ 读文件 %s 失败: %v", *in, err)
}
var df dumpFile
if err := json.Unmarshal(raw, &df); err != nil {
log.Fatalf("✗ 解析 %s 失败: %v", *in, err)
}
db, dcfg, err := openDB(*cfgPath)
if err != nil {
log.Fatalf("✗ %v", err)
}
defer db.Close()
// ① 结构:与后端同一套定义(含 CREATE EXTENSION vector、HNSW 索引、老库兼容迁移)。
log.Printf("→ 收敛目标库结构(AutoMigrate + EnsureDedupSchema)...")
if err := ensureSchema(dcfg); err != nil {
log.Fatalf("✗ 结构初始化失败: %v", err)
}
// ② 数据:关闭外键 / 触发器,避免插入顺序受约束(整库覆盖无需保序)。
if _, err := db.Exec("SET session_replication_role = 'replica'"); err != nil {
log.Fatalf("✗ 关闭约束检查失败: %v", err)
}
defer db.Exec("SET session_replication_role = 'origin'")
for _, t := range df.Tables {
// 先清空目标表(约束已由 replica 角色关闭),再插入。
if _, err := db.Exec(fmt.Sprintf(`DELETE FROM "%s"`, t.Name)); err != nil {
log.Fatalf("✗ 清空表 %s 失败: %v", t.Name, err)
}
if err := importRows(db, t); err != nil {
log.Fatalf("✗ 导数据到 %s 失败: %v", t.Name, err)
}
log.Printf(" ✓ %s: %d 行", t.Name, len(t.Rows))
}
log.Printf("✓ 导入完成(%d 张表)", len(df.Tables))
// writeHeader 写文件头与几个影响字面量解析的会话设置。
func writeHeader(w *bufio.Writer, dcfg *config.DatabaseConfig) {
fmt.Fprintf(w, "-- dbtool 导出:%s\n", dcfg.Addr())
fmt.Fprintf(w, "-- 生成时间:%s\n", time.Now().Format(time.RFC3339))
fmt.Fprintf(w, "-- 导入:psql -U %s -d %s -v ON_ERROR_STOP=1 -f <本文件>\n", dcfg.User, dcfg.Name)
fmt.Fprintln(w, "--")
fmt.Fprintln(w, "-- 注意:目标库必须是空库;本脚本不清表,重复执行会主键冲突。")
fmt.Fprintln(w, "SET client_encoding = 'UTF8';")
fmt.Fprintln(w, "SET standard_conforming_strings = on;")
fmt.Fprintln(w, "SET check_function_bodies = false;")
fmt.Fprintln(w, "SET client_min_messages = warning;")
fmt.Fprintln(w)
}
// ensureSchema 用后端的 database.AutoMigrate + EnsureDedupSchema 把目标库结构
// 收敛到与当前代码一致。这是「结构定义只有一个来源」的落点:
// 表 / 列来自 model 的 GORM tag,扩展与 HNSW 索引来自 EnsureDedupSchema。
func ensureSchema(dcfg *config.DatabaseConfig) error {
gdb, err := gorm.Open(postgres.Open(dcfg.DSN()), &gorm.Config{
Logger: logger.Default.LogMode(logger.Warn),
SkipDefaultTransaction: true,
})
if err != nil {
return fmt.Errorf("连接数据库失败: %w", err)
}
sqlDB, err := gdb.DB()
if err != nil {
return fmt.Errorf("获取底层连接池失败: %w", err)
}
defer sqlDB.Close()
if err := database.AutoMigrate(gdb); err != nil {
return fmt.Errorf("AutoMigrate: %w", err)
}
if err := database.EnsureDedupSchema(gdb); err != nil {
return fmt.Errorf("EnsureDedupSchema: %w", err)
}
return nil
}
// listTables 返回 public 模式下所有基表名。
// listTables 返回 public 下全部基表名(按名字排序,保证导出可复现)。
func listTables(db *sql.DB) ([]string, error) {
rows, err := db.Query(`
SELECT table_name FROM information_schema.tables
WHERE table_schema = 'public' AND table_type = 'BASE TABLE'
ORDER BY table_name`)
SELECT c.relname
FROM pg_class c
JOIN pg_namespace n ON n.oid = c.relnamespace
WHERE n.nspname = 'public' AND c.relkind = 'r'
ORDER BY c.relname`)
if err != nil {
return nil, err
}
defer rows.Close()
var out []string
for rows.Next() {
var name string
@ -289,217 +240,245 @@ func listTables(db *sql.DB) ([]string, error) {
return out, rows.Err()
}
// dumpTable 导出单张表的列元信息 + 数据。
func dumpTable(db *sql.DB, name string) (tableDump, error) {
cols, pk, err := dumpColumns(db, name)
if err != nil {
return tableDump{}, err
}
// listColumns 读取单表全部列的完整结构信息。
func listColumns(db *sql.DB, table string) ([]column, error) {
q := fmt.Sprintf(`
SELECT a.attname,
format_type(a.atttypid, a.atttypmod),
a.attnotnull,
COALESCE(a.attidentity, ''),
COALESCE(pg_get_expr(d.adbin, d.adrelid), '')
FROM pg_attribute a
LEFT JOIN pg_attrdef d ON d.adrelid = a.attrelid AND d.adnum = a.attnum
WHERE a.attrelid = %s::regclass AND a.attnum > 0 AND NOT a.attisdropped
ORDER BY a.attnum`, ql(qname(table)))
dataQuery := fmt.Sprintf(`SELECT * FROM "%s"`, name)
vlog("dump data: %s", dataQuery)
rows, err := db.Query(dataQuery)
rows, err := db.Query(q)
if err != nil {
return tableDump{}, fmt.Errorf("读取数据失败(表 %s): %w\nSQL: %s", name, err, dataQuery)
return nil, err
}
defer rows.Close()
colNames, err := rows.Columns()
if err != nil {
return tableDump{}, err
}
n := len(colNames)
td := tableDump{Name: name, Columns: cols, Pk: pk, Rows: make([][]any, 0)}
scanPtrs := make([]any, n)
raw := make([]sql.RawBytes, n)
for i := range raw {
scanPtrs[i] = &raw[i]
}
var out []column
for rows.Next() {
if err := rows.Scan(scanPtrs...); err != nil {
return tableDump{}, err
var c column
if err := rows.Scan(&c.Name, &c.Type, &c.NotNull, &c.Identity, &c.Default); err != nil {
return nil, err
}
row := make([]any, n)
for i := range raw {
if raw[i] == nil {
row[i] = nil // NULL
} else {
row[i] = string(raw[i]) // 全部按字符串搬运,导入时按列类型转换
}
}
td.Rows = append(td.Rows, row)
c.AutoIncrement = c.Identity != "" || isSerial(c)
out = append(out, c)
}
return td, rows.Err()
return out, rows.Err()
}
// dumpColumns 读取列元信息与主键。
func dumpColumns(db *sql.DB, table string) ([]columnMeta, []string, error) {
// is_identity 必须直接读 information_schema.columns.is_identity:
// identity 列的 column_default 是 NULL,用 column_default LIKE 'nextval(%' 判断
// 会把 GENERATED BY DEFAULT AS IDENTITY 的列全部漏判成「非自增」。
colQuery := strings.Replace(`
SELECT c.column_name,
c.udt_name,
(c.is_nullable = 'YES'),
COALESCE(c.column_default, ''),
(c.is_identity = 'YES')
FROM information_schema.columns c
WHERE c.table_schema = 'public' AND c.table_name = $1
ORDER BY c.ordinal_position`, "$1", quoteLit(table), 1)
vlog("dump columns: table=%q query=%s", table, colQuery)
rows, err := db.Query(colQuery)
// writeCreateTable 由列信息生成 CREATE TABLE。
//
// 两类自增列统一归一为 GENERATED BY DEFAULT AS IDENTITY:
// - 原生 identity 列(attidentity 非空);
// - serial 列(默认值是 nextval,如 image_embeddings.id)。
//
// 归一后不必再单独导出 CREATE SEQUENCE —— identity 子句会自动建序列,
// 也避免了「默认值引用一个还不存在的序列」导致建表失败。
func writeCreateTable(w *bufio.Writer, table string, cols []column) {
fmt.Fprintf(w, "CREATE TABLE IF NOT EXISTS %s (\n", qname(table))
for i, c := range cols {
fmt.Fprintf(w, " %s %s", qi(c.Name), c.Type)
switch {
case c.AutoIncrement:
fmt.Fprint(w, " GENERATED BY DEFAULT AS IDENTITY")
case c.Default != "":
fmt.Fprintf(w, " DEFAULT %s", c.Default)
}
// identity 列本身即 NOT NULL,不重复声明。
if c.NotNull && !c.AutoIncrement {
fmt.Fprint(w, " NOT NULL")
}
if i < len(cols)-1 {
fmt.Fprint(w, ",")
}
fmt.Fprintln(w)
}
fmt.Fprintln(w, ");")
fmt.Fprintln(w)
}
// writeCopyData 用 COPY ... FROM stdin 导出单表数据,返回行数。
//
// 全部值按服务端文本表示搬运;NULL 写成 \N,其余转义反斜杠 / 制表符 / 换行 / 回车。
func writeCopyData(w *bufio.Writer, db *sql.DB, table string, cols []column) (int64, error) {
names := make([]string, len(cols))
for i, c := range cols {
names[i] = qi(c.Name)
}
colList := strings.Join(names, ", ")
fmt.Fprintf(w, "COPY %s (%s) FROM stdin;\n", qname(table), colList)
rows, err := db.Query(fmt.Sprintf("SELECT %s FROM %s", colList, qname(table)))
if err != nil {
return nil, nil, fmt.Errorf("读取列元信息失败(表 %s): %w%s\nSQL: %s", table, err, pgDetail(err), strings.TrimSpace(colQuery))
return 0, err
}
defer rows.Close()
var cols []columnMeta
raw := make([]sql.RawBytes, len(cols))
ptrs := make([]any, len(cols))
for i := range raw {
ptrs[i] = &raw[i]
}
var count int64
for rows.Next() {
var name, udt, def string
var nullable, isIdentity bool
if err := rows.Scan(&name, &udt, &nullable, &def, &isIdentity); err != nil {
return nil, nil, err
if err := rows.Scan(ptrs...); err != nil {
return count, err
}
cols = append(cols, columnMeta{
Name: name, Type: udt, IsNullable: nullable, IsIdentity: isIdentity, Default: def,
})
for i := range raw {
if i > 0 {
w.WriteByte('\t')
}
if raw[i] == nil {
w.WriteString(`\N`)
continue
}
w.WriteString(escapeCopy(raw[i]))
}
w.WriteByte('\n')
count++
}
if err := rows.Err(); err != nil {
return nil, nil, err
return count, err
}
pkQuery := strings.Replace(`
SELECT kcu.column_name
FROM information_schema.table_constraints tc
JOIN information_schema.key_column_usage kcu
ON kcu.constraint_name = tc.constraint_name AND kcu.table_schema = tc.table_schema
WHERE tc.table_schema = 'public' AND tc.table_name = $1 AND tc.constraint_type = 'PRIMARY KEY'
ORDER BY kcu.ordinal_position`, "$1", quoteLit(table), 1)
vlog("dump pk: %s", strings.TrimSpace(pkQuery))
pkRows, err := db.Query(pkQuery)
if err != nil {
return nil, nil, fmt.Errorf("读取主键失败(表 %s): %w\nSQL: %s", table, err, strings.TrimSpace(pkQuery))
}
defer pkRows.Close()
var pk []string
for pkRows.Next() {
var c string
if err := pkRows.Scan(&c); err != nil {
return nil, nil, err
}
pk = append(pk, c)
}
return cols, pk, pkRows.Err()
fmt.Fprintln(w, `\.`)
fmt.Fprintln(w)
return count, nil
}
// castFor 返回列类型对应的 pg 类型转换后缀(用于导入时把字符串值转为正确类型)。
func castFor(udt string) string {
switch udt {
case "int2", "int4", "int8":
return "bigint"
case "numeric":
return "numeric"
case "float4", "float8":
return "double precision"
case "bool":
return "boolean"
case "timestamp":
return "timestamp"
case "timestamptz":
return "timestamptz"
case "date":
return "date"
case "time":
return "time"
case "json", "jsonb":
return "jsonb"
case "uuid":
return "uuid"
default:
return "" // text / varchar / char 等字符串类型无需转换
}
}
// writeConstraints 导出主键等约束定义(pg_get_constraintdef 给出完整定义,无需自己拼)。
func writeConstraints(w *bufio.Writer, db *sql.DB, table string) error {
q := fmt.Sprintf(`
SELECT con.conname, pg_get_constraintdef(con.oid)
FROM pg_constraint con
WHERE con.conrelid = %s::regclass
ORDER BY CASE con.contype
WHEN 'p' THEN 1 WHEN 'u' THEN 2 WHEN 'c' THEN 3 WHEN 'x' THEN 4 WHEN 'f' THEN 5 ELSE 9
END,
con.conname`, ql(qname(table)))
// importRows 把一张表的数据批量 INSERT 进目标库(单表一个事务,每批多行)。
func importRows(db *sql.DB, t tableDump) error {
if len(t.Rows) == 0 {
return nil
}
hasIdentity := false
for _, c := range t.Columns {
if c.IsIdentity {
hasIdentity = true
break
}
}
tx, err := db.Begin()
rows, err := db.Query(q)
if err != nil {
return err
}
defer func() { _ = tx.Rollback() }()
defer rows.Close()
colList := make([]string, len(t.Columns))
casts := make([]string, len(t.Columns))
for i, c := range t.Columns {
colList[i] = `"` + c.Name + `"`
casts[i] = castFor(c.Type)
}
const batchSize = 200
for start := 0; start < len(t.Rows); start += batchSize {
end := start + batchSize
if end > len(t.Rows) {
end = len(t.Rows)
}
chunk := t.Rows[start:end]
var sb strings.Builder
ov := ""
if hasIdentity {
ov = " OVERRIDING SYSTEM VALUE"
}
sb.WriteString(fmt.Sprintf(`INSERT INTO "%s" (%s)%s VALUES `, t.Name, strings.Join(colList, ","), ov))
args := make([]any, 0, len(chunk)*len(t.Columns))
param := 1
for ri, row := range chunk {
if ri > 0 {
sb.WriteString(",")
}
sb.WriteString("(")
for ci, val := range row {
if ci > 0 {
sb.WriteString(",")
}
if val == nil {
sb.WriteString("NULL")
} else {
if casts[ci] != "" {
sb.WriteString(fmt.Sprintf("$%d::%s", param, casts[ci]))
} else {
sb.WriteString(fmt.Sprintf("$%d", param))
}
args = append(args, val)
param++
}
}
sb.WriteString(")")
}
if _, err := tx.Exec(sb.String(), args...); err != nil {
for rows.Next() {
var name, def string
if err := rows.Scan(&name, &def); err != nil {
return err
}
fmt.Fprintf(w, "ALTER TABLE ONLY %s ADD CONSTRAINT %s %s;\n", qname(table), qi(name), def)
}
fmt.Fprintln(w)
return rows.Err()
}
// 重置 identity 序列,避免后续自增插入与已导入的最大 ID 冲突。
for _, c := range t.Columns {
if c.IsIdentity {
seq := fmt.Sprintf("pg_get_serial_sequence('%s','%s')", t.Name, c.Name)
if _, err := tx.Exec(fmt.Sprintf(
`SELECT setval(%s, COALESCE((SELECT MAX("%s") FROM "%s"), 1))`, seq, c.Name, t.Name)); err != nil {
log.Printf("! 重置序列 %s.%s 失败: %v", t.Name, c.Name, err)
}
// writeIndexes 导出不承载约束的索引(含 pgvector 的 HNSW)。
//
// 排除承载约束的索引:主键索引已由 writeConstraints 以 ADD CONSTRAINT 的形式重建,
// 再 CREATE INDEX 一次会重复。
func writeIndexes(w *bufio.Writer, db *sql.DB, table string) error {
q := fmt.Sprintf(`
SELECT i.relname, pg_get_indexdef(i.oid)
FROM pg_index x
JOIN pg_class i ON i.oid = x.indexrelid
WHERE x.indrelid = %s::regclass
AND NOT EXISTS (SELECT 1 FROM pg_constraint con WHERE con.conindid = x.indexrelid)
ORDER BY i.relname`, ql(qname(table)))
rows, err := db.Query(q)
if err != nil {
return err
}
defer rows.Close()
for rows.Next() {
var name, def string
if err := rows.Scan(&name, &def); err != nil {
return err
}
fmt.Fprintf(w, "%s;\n", injectIfNotExists(def))
}
fmt.Fprintln(w)
return rows.Err()
}
// writeSequenceResets 为每个自增列把序列推到 MAX(col)+1。
//
// COPY 写入的是显式 id,不会推进序列;不重置的话,后续 INSERT 会从 1 开始并与存量主键冲突。
// setval 用 (值, false) 形式:false 表示「这个值还没被取走」,故下一次 nextval 正好是 max+1;
// 空表时为 1,即从 1 开始。
func writeSequenceResets(w *bufio.Writer, table string, cols []column) {
for _, c := range cols {
if !c.AutoIncrement {
continue
}
fmt.Fprintf(w,
"SELECT pg_catalog.setval(pg_get_serial_sequence(%s, %s), COALESCE((SELECT MAX(%s) FROM %s), 0) + 1, false);\n",
ql(qname(table)), ql(c.Name), qi(c.Name), qname(table))
}
}
// isSerial 判断是否为 serial 列(默认值 nextval,且类型为整型)。
func isSerial(c column) bool {
if !strings.HasPrefix(c.Default, "nextval(") {
return false
}
switch c.Type {
case "bigint", "integer", "smallint":
return true
default:
return false
}
}
// escapeCopy 转义 COPY 文本格式里的特殊字符。
// 先处理反斜杠,保证字面量 `\N` 被写成 `\\N` 而不会变成 NULL。
func escapeCopy(b []byte) string {
var sb strings.Builder
sb.Grow(len(b) + 8)
for _, c := range b {
switch c {
case '\\':
sb.WriteString(`\\`)
case '\t':
sb.WriteString(`\t`)
case '\n':
sb.WriteString(`\n`)
case '\r':
sb.WriteString(`\r`)
default:
sb.WriteByte(c)
}
}
return tx.Commit()
return sb.String()
}
// injectIfNotExists 给 pg_get_indexdef 的输出补上 IF NOT EXISTS。
// pg_get_indexdef 不会输出它(那是 pg_dump 的清理语义),补上可让索引段落可重复执行。
func injectIfNotExists(def string) string {
if rest, ok := strings.CutPrefix(def, "CREATE UNIQUE INDEX "); ok {
return "CREATE UNIQUE INDEX IF NOT EXISTS " + rest
}
if rest, ok := strings.CutPrefix(def, "CREATE INDEX "); ok {
return "CREATE INDEX IF NOT EXISTS " + rest
}
return def
}
// qname 返回 schema 限定且带引号的表名:public."brands"。
func qname(table string) string { return "public." + qi(table) }
// qi 安全包裹 SQL 标识符(表名 / 列名 / 索引名)。
func qi(s string) string { return `"` + strings.ReplaceAll(s, `"`, `""`) + `"` }
// ql 安全包裹 SQL 字符串字面量。
func ql(s string) string { return "'" + strings.ReplaceAll(s, "'", "''") + "'" }