oracle data guard 不支持直接限制日志传输带宽,需通过 cgroup 或 tc 在操作系统层实现,且必须排除 rfs、mrp 等关键进程,否则将导致传输卡顿或中断。

Oracle Data Guard 本身不提供直接限制日志传输带宽的参数或开关——你不能像限速下载那样给 ARCH 或 RFS 进程配个“10MB/s”上限。真要控带宽,得绕到操作系统层,用 cgroup 或网络 QoS 实现,且必须避开关键进程。
为什么不能在 LOG_ARCHIVE_DEST_n 里设 bandwidth limit?
Oracle 没有 BANDWIDTH_LIMIT、MAX_THROUGHPUT 这类归档目标参数。所有 LOG_ARCHIVE_DEST_n 支持的选项(如 COMPRESSION=ENABLE、NET_TIMEOUT、REOPEN)都作用于连接可靠性或压缩行为,不控制速率。试图在 TNS 描述符或 sqlnet.ora 里加限速配置,会被 Oracle Net 忽略。
用 cgroup 限制 oracle 用户整体 IO 带宽(但必须放行 RFS/MRP 等关键进程)
这是生产环境最常用、最可控的方式,尤其适用于备库磁盘 I/O 瓶颈导致应用延迟的场景。核心逻辑是:限制读写总量,但把日志接收和应用进程踢出限制组。
-
blkio.throttle.read_bps_device和blkio.throttle.write_bps_device是唯一能按设备粒度限速的 cgroup v1 参数,单位是 byte/s - 必须先查清磁盘主次设备号:
lsblk输出中的MAJ:MIN(如vdb对应253:16),不能写错 - 限制的是整个
oracle用户所有进程的 IO,所以必须手动把以下进程移出限制组:RFS(接收日志)、MRP(应用日志)、LGWR(写在线日志)、DBW(写数据文件)、ARC(归档) - 执行
cgclassify -g blkio:/ <pid></pid>将进程移到根组,否则它们也会被限速,导致传输卡顿甚至中断
用 tc(traffic control)在网卡层限速(仅适用于跨网段同步)
如果主备库走的是独立网段(比如专用于 DG 的 10G 网口),可以用 Linux tc 做出口限速。但要注意这会影响所有走该网卡的流量,包括监听器、SQL*Net 连接等。
- 限速目标应设在主库发包方向(
ifb或egress),不是备库收包侧 - 避免用
htb类复杂队列,优先选netem+tbf组合,例如:tc qdisc add dev eth1 root tbf rate 50mbit burst 32kbit latency 400ms - 该设置不区分 Oracle 流量和其他流量;若主库还跑应用,需配合
iptables + fwmark做流分类,否则会误伤业务连接 - 限速值建议不低于日志生成峰值的 1.2 倍,否则
ARCH进程会积压归档,触发ORA-00312或log file switch (archiving needed)等等待事件
真正难的不是怎么限,而是判断该不该限——多数情况下,日志传输慢是因为归档写入慢、备库应用慢,或者网络抖动丢包,而不是带宽真被跑满。盲目限速反而会让积压恶化。先确认 V$DATAGUARD_STATS 中 transport lag 是否持续增长,再查 V$MANAGED_STANDBY 里 RFS 状态是否为 IDLE,最后看 top 里 ARCH 和 MRP 的 CPU/IO 占比。这些信号比带宽数字更真实。











