ogg在19c rac中lag at chkpt持续增长但无报错,是rac线程间日志捕获不均衡所致:集成抽取默认只读本地节点归档,若高scn日志集中于其他节点且未启用tranlogoptions dblogreader,或streams_pool_size=0、extract未跨节点注册、adg归档路径不统一,均会导致该现象。

OGG在19c RAC中跨节点抓取时,Lag at Chkpt持续增长但无报错
这不是“进程卡死”,而是RAC线程间日志捕获不均衡的典型表现。集成抽取(Integrated Extract)依赖数据库内部的LogMiner服务,而该服务在RAC中默认只绑定到本地实例——若归档日志由其他节点生成且未被当前Extract所在节点及时访问,就会出现“看到SCN但读不到对应redo”的延迟假象。
验证方法:GGSCI> info extract <process_name>, showch</process_name> 查看 Current read position 和 Checkpoint SCN 是否长期停滞在某个节点的thread#上;再查 v$archived_log,确认高SCN归档是否集中在另一节点。
- 优先检查
DBA_HIST_ACTIVE_SESS_HISTORY中 Extract 对应的program字段是否固定为ora_cjq0_*或ora_q00*—— 这说明 LogMiner 后台进程被调度到了非主日志生成节点 - 确认 Extract 参数中是否遗漏
TRANLOGOPTIONS DBLOGREADER:该选项启用跨实例日志读取能力,19c+ 必须显式开启,否则默认只读本节点归档 - 避免使用
BEGIN NOW启动:它可能让 Extract 错过刚切换的线程头,改用BEGIN AT SCN <scn></scn>并指定一个已知多节点都已归档的SCN
Time Since Chkpt极小但Lag at Chkpt极大,说明检查点推进正常但数据没出来
这指向“事务可见性”问题:Extract 已记录检查点,但下游尚未收到对应事务的commit record。常见于RAC中全局队列(GES)争用或undo段跨节点访问延迟。
关键排查点是 v$transaction 和 v$fast_start_transactions:若发现大量 state = 'PREPARED' 或 recovery_block# 为空,说明事务提交未完成广播。
- 检查 RAC 的
gc cr block lost和gc current block lost等等待事件是否异常升高(AWR报告中 Top 5 Events) - 确认 Extract 所连数据库用户是否具有
SELECT_CATALOG_ROLE+EXECUTE_CATALOG_ROLE:缺少后者会导致无法解析跨实例的undo segment header - 禁用
DDL INCLUDE临时测试:DDL语句在RAC中需协调多个实例元数据锁,极易引发阻塞,可先注释掉参数中的DDL INCLUDE行观察延迟是否下降
远程捕获(Remote Capture)模式下EXTRACT进程显示RUNNING却零输出
这是最隐蔽的陷阱——进程状态正常,但实际未消费任何日志。根本原因是远程捕获依赖 streams_pool_size,而19c RAC默认该参数为0,且OGG不会主动报错,仅静默降级为低效轮询。
查证命令:show parameter streams_pool_size;若返回 0 或空值,即为根因。
- 必须在所有RAC节点执行:
alter system set streams_pool_size=1G scope=both sid='*';(注意sid='*',不能只设单节点) - 重启 Extract 前,先在 GGSCI 中执行:
stop extract <process_name></process_name>→delete extract <process_name></process_name>→register extract <process_name> database</process_name>:重新注册强制刷新LogMiner上下文 - 避免混用
INTEGRATED TRANLOG和CLASSIC TRANLOG配置:远程捕获只支持集成模式,若参数文件中残留TRANLOGOPTIONS下的 classic 专属选项(如ALTARCHIVELOGFORMAT),会导致初始化失败但不报错
ADG备库上部署经典Extract后延迟突增,且info all显示Lag at Chkpt跳变
经典Extract无法从ADG备库做集成捕获,但能以经典模式运行——前提是归档日志路径对所有RAC节点**物理可达且一致**。一旦某节点归档写入本地ASM磁盘组而其他节点无法挂载,Extract就会在该节点反复重试、超时、跳过,最终表现为检查点跳跃式前进。
典型错误日志片段:WARNING OGG-01223 Cannot open archived log file ... ORA-17627
- 检查
v$archive_dest_status中所有destination的status是否全为VALID,特别关注standby_archive_dest路径是否跨节点统一 - 不要依赖
log_archive_dest_2的默认值:必须显式配置为共享文件系统(如NFS)或统一ASM别名,例如alter system set log_archive_dest_2='SERVICE=stby SYNC VALID_FOR=(ONLINE_LOGFILES,PRIMARY_ROLE) DB_UNIQUE_NAME=stby' scope=both; - 在 Extract 参数中禁用
DBLOGREADER:ADG场景下该选项无效,反而会触发不必要的ASM连接尝试,增加超时概率
Lag at Chkpt成为“幽灵指标”。











