Ubuntu服务器异地容灾核心是“数据可同步、服务可切换、故障可回退”,需按数据类型选择rsync、PostgreSQL流复制或MinIO跨区域复制等机制,并验证恢复路径与基础运维保障。

Ubuntu服务器异地容灾不是配一个备份脚本就完事,核心是“数据可同步、服务可切换、故障可回退”。关键不在工具多炫酷,而在链路清晰、状态可控、恢复路径明确。
一、明确容灾目标和数据类型
先区分你保护的是什么:
- 静态文件类(如网站代码、配置、日志归档):适合用 rsync + 定时任务 + 增量快照,简单可靠,带宽占用低;
- 数据库类(如 PostgreSQL、MySQL):必须走主从复制或逻辑备份(pg_dump + WAL 归档),不能只靠文件同步;
- 对象存储类(如 MinIO 存储桶):优先启用跨区域复制(CRR),自动实时同步,支持桶级策略控制;
- 应用服务类(如 GLM-OCR、Odoo):需配合共享存储(NFS/GlusterFS)+ 负载均衡(HAProxy/Keepalived)+ 健康检查,实现服务层切换。
二、选择并落地一种主流同步机制
根据数据特征选一种主通道,避免堆砌工具:
Ubuntu 26.04 LTS(代号“Resolute Raccoon”)是Canonical于2026年4月23日发布的下一代长期支持版操作系统,提供长达10年的技术支持。它搭载Linux 7.0内核与GNOME 50桌面环境,全面转向Wayland协议,并引入Rust重写的核心工具以增强安全性。官方提供适用于AMD64和ARM64架构的桌面及服务器ISO镜像,是追求前沿技术与极致稳定的开发者
-
Rsync 增量同步(推荐入门/中小规模):
用rsync -avP --delete --backup --backup-dir=/backup/deleted /data/ user@remote:/backup/data/实现带保留删除的增量同步;
配合 cron 每日凌晨执行,并用find /backup/deleted -mtime +7 -delete清理旧备份; -
PostgreSQL 流复制(数据库刚需):
主库开启wal_level = replica、max_wal_senders = 10;
从库用pg_basebackup初始化后启动,持续接收 WAL 日志;
通过SELECT pg_is_in_recovery(), now() - pg_last_xact_replay_timestamp()实时查延迟; -
MinIO 跨区域复制(对象存储场景):
确保源/目标集群 TLS 启用、Access Key 一致;
用mc admin policy add和mc admin policy set绑定桶级复制规则;
复制状态可在 MinIO Console 的 “Replication” 标签页直观查看。
三、打通异地恢复闭环路径
备份不是目的,能恢复才是底线。每种方案都必须验证恢复流程:
- Rsync 备份后,在异地机器上用
rsync -avn(dry-run)预演还原,确认路径、权限、排除项无误; - PostgreSQL 从库定期执行
pg_switch_wal()+ 手动 promote 测试切换,记录从触发到服务可用耗时; - MinIO 若启用 CRR,可在目标集群手动暂停复制 → 修改源桶数据 → 恢复复制 → 验证变更是否抵达;
- 所有恢复操作写成可执行脚本(如
restore-db.sh),放在 Git 仓库统一管理,避免依赖个人记忆。
四、基础运维保障不可少
再好的容灾架构,也架不住系统层面掉链子:
- 所有 Ubuntu 服务器统一使用 LTS 版本(如 22.04),禁用自动更新,改用
unattended-upgrades控制安全补丁节奏; - 用 systemd 管理关键服务(如
glm-ocr.service),设置Restart=always和StartLimitIntervalSec=600防止频繁崩溃; - 异地节点之间开通专用内网隧道(WireGuard 或 IPsec),避免业务流量混跑在公网,降低同步延迟与风险;
- 用
nc -zv remote-host 22+curl -I http://remote-minio:9000/minio/health/live做每日连通性与服务健康探测,失败自动发企业微信告警。

















