ASM磁盘脱机后应先查v$asm_disk确认真实状态:state为OFFLINE表示人为下线,MISSING表示物理故障;repair_timer>0说明仍在修复窗口内,可尝试ONLINE;仅当repair_timer=0且磁盘不可恢复时才DROP,外部冗余下DROP将导致数据永久丢失。

ASM磁盘脱机后状态怎么看?
先别急着操作,v$asm_disk 里查清楚当前真实状态才是关键。脱机不等于丢失,更不等于立刻要删——很多误操作就栽在这一步。
执行:
SELECT name, path, state, mode_status, repair_timer FROM v$asm_disk WHERE group_number = X;重点关注三列:
-
state是OFFLINE还是MISSING?前者可能是人为ALTER DISKGROUP ... DROP DISK或强制下线;后者才是物理/链路故障触发的自动标记 -
repair_timer> 0 表示 ASM 还在等你修好它(默认窗口 3.6 秒,由_asm_disk_repair_time控制),此时磁盘没被真正踢出,镜像数据仍在同步中 -
mode_status若为OFFLINE且repair_timer= 0,说明已超时,ASM 已将其移出磁盘组并启动重平衡
能 ONLINE 就别 DROP,但必须确认路径和权限
如果磁盘只是临时掉线(比如 HBA 卡闪断、多路径切换延迟),且 repair_timer 还在倒计时,优先尝试恢复在线:
执行:
ALTER DISKGROUP dg_name ONLINE DISK 'ORCL:DISK01';
但注意这步常失败,原因很实际:
- 路径变了:存储映射重刷后,
/dev/oracleasm/disks/DISK01可能变成/dev/mapper/mpathb,path列显示的旧路径已无效 - 权限不对:
grid用户对新设备节点无读写权限,ls -l看属主是不是grid:asmadmin - udev 规则失效:重启后未重新加载规则,导致设备名不稳定,建议用 WWID 绑定而非 /dev/sdX
必须 DROP 时,FORCE 选项不是万能钥匙
只有当磁盘物理消失(拔了没换)、或路径彻底不可达、且 repair_timer 已归零时,才考虑 DROP DISK。但别直接上 FORCE:
ALTER DISKGROUP dg_name DROP DISK 'ORCL:DISK01'; —— 这是标准流程,ASM 会先释放 Extent 再启动重平衡
ALTER DISKGROUP dg_name DROP DISK 'ORCL:DISK01' FORCE; —— 仅用于磁盘已不在系统中、且 ASM 仍认为它“存在”(比如 state=PROVISIONED 或卡在 FORMER),否则可能引发元数据不一致
常见坑:
- 外部冗余(
EXTERNAL REDUNDANCY)磁盘组下 DROP = 数据永久丢失,没备份就别动 - 执行前务必确认
v$asm_operation为空,否则 DROP 会被阻塞,报错ORA-15053 - RAC 环境中,DROP 必须在所有节点都看到该磁盘为
MISSING后,由一个节点发起,其他节点自动同步状态
新加磁盘后 rebalance 卡住,别只调 POWER
加盘后执行 ALTER DISKGROUP ... ADD DISK,发现 v$asm_operation 显示 EXECUTING 却无进度,别第一反应就是 REBALANCE POWER 11:
先查根本原因:
- 检查
v$css_history和v$asm_client,确认所有 RAC 节点的 ASM 实例状态正常,有没有INTERMEDIATE或FAILED记录 - 看
ASMCMD> lsdg输出的state是否为MOUNTED,有节点没 mount 会导致 rebalance 挂起 - 确认没人在同一磁盘组做其他变更(比如改 AU size、加另一个 disk),否则会中断当前 rebalance
真要调 POWER,记住:POWER 5 对 20TB 磁盘组是合理起点,POWER 11 会吃光 I/O 带宽,业务高峰期慎用。


















