Oracle Data Guard归档传输卡在ERROR/DEFERRED且日志出现ORA-12170或TNS-12535,本质是网络闪断致RFS进程未恢复连接;需人工干预:查V$MANAGED_STANDBY确认RFS状态,主库查V$ARCHIVE_DEST_STATUS定位ERROR原因,强制执行ALTER SYSTEM ARCHIVE LOG CURRENT触发重试,并确保LOG_ARCHIVE_DEST_2配置REOPEN=60而非默认0。

Oracle Data Guard 归档传输卡在 ERROR/DEFERRED 状态,且日志里反复出现 ORA-12170 或 TNS-12535,基本可以断定是网络闪断后 RFS 进程没恢复连接 —— 这不是 Broker 自动重试能解决的问题,必须人工干预链路状态。
查 RFS 进程是否真断连(别只看 alert 日志)
备库上直接查 V$MANAGED_STANDBY,重点看 RFS 进程的 STATUS 和 CLIENT_PROCESS:
- STATUS = IDLE 且 CLIENT_PROCESS 为空 → RFS 已彻底退出,监听没收到新连接请求
- STATUS = CONNECTED 但 SEQUENCE# 长时间(>3 分钟)不更新 → RFS 挂着但收不到主库发来的归档,大概率是主库 ARCH 没推、或中间网络拦截了重传包
- STATUS = RECOVERING 但 APPLY_LAG 在涨 → RFS 活着,MRP0 却没跟上,说明日志流“进得来但消化不了”,先别急着修网络,查备库磁盘 I/O 或 SRL 是否满
确认主库 ARCH 是否还在推送(90% 的误判发生在这里)
主库执行:SELECT DEST_ID, STATUS, ERROR, TRANSMIT_MODE FROM V$ARCHIVE_DEST_STATUS WHERE DEST_ID = 2;
- STATUS 是 VALID 但 ERROR 字段含
ORA-12170: TNS:Connect timeout occurred→ 主库知道连不上,但没触发自动重试(默认只重试 1 次,REOPEN=300是间隔不是次数) - STATUS 是 DEFERRED → DBA 手动执行过
ALTER SYSTEM SET LOG_ARCHIVE_DEST_STATE_2=DEFER,Broker 不会自动取消 defer,必须手动ENABLE - TRANSMIT_MODE 是 ASYNC 但备库监听端口被防火墙临时封掉 → 网络恢复后,主库不会主动探测,要靠
ALTER SYSTEM ARCHIVE LOG CURRENT强制触发一次归档切换才能唤醒 ARCH 重试
强制重建 RFS 连接的实操动作
别重启监听、别杀进程、别 reload listener.ora —— 这些对已建立的 RFS 连接无效。真正起效的是以下三步组合:
- 在主库执行
ALTER SYSTEM ARCHIVE LOG CURRENT,确保有新日志产生并触发 ARCH 尝试推送 - 在备库执行
ALTER SYSTEM SWITCH LOGFILE(仅限物理备库),强制 MRP0 切换到下一个日志组,同时会清理旧 RFS 连接缓存 - 如果仍无响应,在备库用
lsnrctl services确认监听是否注册了<db_unique_name>_DGMGRL</db_unique_name>服务名;若缺失,需在listener.ora中补全SID_DESC并lsnrctl reload
为什么 Broker 不自动重连?关键参数被忽略了
Broker 默认依赖底层网络栈的 TCP keepalive,而 Oracle 的 RFS 连接默认不启用应用层心跳。真正控制重连行为的是两个常被忽略的归档目标属性:
-
NET_TIMEOUT=30:只影响同步模式下主库等待备库 ACK 的超时,和 RFS 建连无关 -
REOPEN=60:这是关键!它定义 ARCH 在失败后隔多久重试一次,但默认值是 0(即不重试)。必须显式设为非零值,例如:ALTER SYSTEM SET LOG_ARCHIVE_DEST_2='SERVICE=standby_db ASYNC VALID_FOR=(ONLINE_LOGFILES,STANDBY_ROLE) DB_UNIQUE_NAME=standby_db REOPEN=60'; - 改完后必须
ALTER SYSTEM ARCHIVE LOG CURRENT才会生效,Broker 不会热加载该参数
最易被跳过的点:REOPEN 参数改了但没切日志,或者改的是 LOG_ARCHIVE_DEST_1(主库本地归档)而非 DEST_2(到备库的远程归档)。网络恢复后,RFS 连接不会自己“醒来”,它等着主库 ARCH 主动推一发新日志过来 —— 而 ARCH 只在有新日志可归档时才行动。


















