主备切换后vip不漂移且应用连不上新主库,本质是rac不自动迁移vip和服务注册,需手动执行srvctl start database、lsnrctl reload、配置local_listener/remote_listener,并同步ocr角色与资源依赖。

主备切换后VIP不漂移,应用连不上新主库
Oracle RAC Data Guard 切换完成后,应用仍连旧IP或报 ORA-12541: TNS:no listener,本质是服务没自动迁移到新主库节点。RAC本身不管理VIP迁移逻辑,必须靠Clusterware(如Oracle Grid Infrastructure)或第三方高可用组件驱动。
常见错误现象:切换后crsctl stat res -t显示数据库资源状态为OFFLINE,或VIP资源仍在原节点运行;srvctl status database -d xxx返回not running;监听器日志中无新主库连接请求。
- 确认切换后是否执行了
srvctl start database -d xxx—— DG switchover 不自动启动新主库实例,需手动或脚本触发 - 检查
srvctl config vip -n 节点名输出的VIP绑定关系,确保新主库所在节点已注册该VIP - 验证
srvctl config database -d xxx中的Oracle home和SPFILE路径是否指向新主库有效路径,否则启动失败 - 若用DNS做服务发现,注意TTL缓存——切换后需强制刷新或改用VIP+SCAN IP组合,避免依赖域名解析
监听器未重载,新主库端口不可达
RAC切换后监听器仍监听旧实例名或未加载新数据库服务名,导致客户端TNS连接失败。监听器不会自动感知DG角色变化,必须显式重载或重启。
典型表现:lsnrctl status 显示服务名仍为orcl_DGMGRL(DG管理服务),而实际数据库服务名(如orcl)未注册;tnsping 通但 sqlplus /@tns_alias 报 ORA-12514: TNS:listener does not currently know of service requested。
- 在新主库节点执行
lsnrctl reload,强制监听器重新读取listener.ora和数据库动态注册信息 - 确认
local_listener参数已设为本节点VIP+端口,例如:ALTER SYSTEM SET local_listener='(ADDRESS=(PROTOCOL=TCP)(HOST=192.168.1.101)(PORT=1521))' SCOPE=BOTH; - 检查
remote_listener是否指向SCAN地址(如scan.example.com:1521),RAC环境下必须配置,否则集群内跨节点连接异常 - 避免在
listener.ora中硬编码SID_LIST—— 动态注册失效时才启用静态注册,且需同步更新SID_NAME
应用连接池未适配,持续复用旧连接
即使VIP和监听器正常,Java或.NET连接池可能缓存旧连接、未及时关闭或未配置重试机制,导致切换后大量请求仍打向已下线的旧主库。
错误日志常含:java.sql.SQLRecoverableException: IO Error: Connection reset 或 ORA-03113: end-of-file on communication channel,而非明确的连接拒绝。
- 连接字符串中禁用
ENABLE=BROKEN,该参数会跳过连接有效性检测,掩盖故障 - 设置连接池最小空闲数为0、最大空闲时间≤30秒,强制连接快速回收
- 启用JDBC URL中的故障转移参数:
failover=true&loadBalance=false&connectTimeout=5000&networkTimeout=10000 - 若用UCP或HikariCP,务必开启
validConnectionCheckerClassName并指向oracle.jdbc.pool.OracleValidConnectionChecker
OCR和资源依赖未更新,集群无法接管
在Oracle Grid Infrastructure环境中,DG切换后若未同步更新OCR中数据库资源的状态依赖,Clusterware可能拒绝启动新主库,或启动后立即被拉起又终止。
现象:crsctl stat res ora.xxx.db -p | grep STATE 返回 STATE=OFFLINE;crsctl check cluster 正常但数据库资源始终不online;alert日志出现 CRS-2674: Start of 'ora.xxx.db' on 'node1' failed。
- 切换完成后立即执行:
srvctl modify database -d xxx -r PRIMARY,显式告知GI当前角色 - 检查资源依赖链:
crsctl stat res -p ora.xxx.db | grep -E "(START_DEPENDENCIES|STOP_DEPENDENCIES)",确保依赖的VIP、监听器资源名与当前环境一致 - 若OCR中仍引用旧磁盘组路径(如
+DATA11),需同步更新:srvctl modify database -d xxx -a "+DATA19" - 不要手动修改OCR内容——所有变更必须通过
srvctl或crsctl命令,否则下次GI重启可能校验失败











