ocrconfig -restore 是唯一合法恢复命令,需 root 执行且文件必须为原始 .ocr 镜像、属主 root 权限 600、含 “Oracle Cluster Registry” 字样;恢复前须停所有节点 CRS,单节点独占启动 ASM 并确保 OCR 设备就绪。

ocrconfig -restore 是唯一可用命令,别用 ocr_ocrconfig
根本不存在 ocr_ocrconfig 这个命令,所有搜到或文档里写的都是拼写错误或脚本误命名。真正能恢复 OCR 自动备份的只有 ocrconfig,且必须由 root 用户执行,路径通常是 /u01/app/19.0.0/grid/bin/ocrconfig(版本不同路径略有差异)。敲 ocr_ocrconfig -showbackup 会直接报 command not found,浪费时间。
验证是否可用:在任意节点以 root 执行 ocrconfig -showbackup auto。若返回空或报 PROT-602,说明 OCR 设备已不可读,不能直接恢复——得先解决 ASM 磁盘组挂载、OCR 设备路径或权限问题。
自动备份文件必须同时满足三个硬条件
ocrconfig -restore 不是“选个文件点一下”,它对输入文件有严格校验。以下三点缺一不可:
- 文件必须是原始
.ocr物理镜像(如backup00.ocr或带时间戳的rac1_20260721_040000.ocr),不能是.tar、.zip或重命名后的副本 - 文件属主必须为
root,权限必须为600(chmod 600 /path/to/backup.ocr),否则静默失败或报PROT-1: Failed to open file - 文件内容必须合法:用
file /path/to/backup.ocr检查输出含Oracle Cluster Registry字样;若输出是 XML 或文本,说明这是ocrconfig -export生成的逻辑备份,不适用于-restore
恢复前必须停集群 + 独占启动 ASM
OCR 恢复不是在线操作。常见翻车点是只在单节点执行 ocrconfig -restore,其他节点仍跑着旧状态,导致集群无法启动。
正确流程是:
- 所有节点执行
crsctl stop crs -f,确保 CRS 完全停止 - 仅在一个节点执行
crsctl start crs -excl -nocrs—— 这会启动 OHASD 和 ASM 实例,但不启动crsd,从而获得对 OCR 设备的独占写入权 - 确认 OCR 设备已就绪:ASM 磁盘组必须已 mount(如
+OCR),且asmcmd lsdg显示USABLE_FILE_MB > 0;若磁盘组被删过,需先用CREATE DISKGROUP重建,compatible.asm必须匹配原版本(如 11.2.0.0.0) - 此时再运行
ocrconfig -restore /path/to/backup00.ocr
还原后三重验证缺一不可
只跑一次 ocrcheck 不代表 OCR 真恢复成功。RAC 环境下容易忽略的是节点间一致性与 CSS 层状态。
必须依次执行:
-
ocrcheck:确认状态为healthy,且Device/File Name指向正确的 ASM 磁盘组(如+OCR) -
ocrdump -backupfile /path/to/backup00.ocr:生成OCRDUMPFILE,检查其中关键键值(如CLUSTER_NAME、CRS_VERSION)是否与预期一致 -
crsctl query css votedisk:确保 voting disk 路径已同步更新(尤其当 OCR 和 voting disk 同在一张磁盘组时);若未同步,需手动执行crsctl replace votedisk +OCR
最后停掉独占模式(crsctl stop crs -f),再在所有节点并行执行 crsctl start crs。任何一步跳过,都可能让集群卡在 CRS-4639 或 ORA-01034。


















