oracle 19c rac客户端偶发超时主因是dns解析卡顿、监听器反向dns查询阻塞(默认30秒超时)及sqlnet.inbound_connect_timeout过小(默认60秒),需同步配置hosts、禁用tcp.reverse_dns_checking、调大inbound timeout至180秒,并排查scan ip冲突与dns负向缓存。

Oracle 19c RAC 客户端连接偶尔超时,90% 不是网络不通,而是 DNS 解析卡顿、反向查询阻塞或服务端 inbound timeout 不足——这几个点没调对,光改 JDBC 超时参数毫无意义。
tnsping 卡在 “Attempting to contact” 就能定位 DNS 问题
tnsping 输出里出现明显停顿(比如 “Attempting to contact (DESCRIPTION=...” 后等 5–30 秒才出 OK),基本锁定在解析环节:
- 用
nslookup rac-scan.example.com和dig rac-scan.example.com测各 SCAN IP 的响应时间;超过 1 秒就要警惕,2 秒以上基本可判定为瓶颈 - 临时把
tnsnames.ora中所有HOST=rac-node1.example.com换成对应 IP(如HOST=192.168.10.11),再试sqlplus /@racdb;秒连即证实是 DNS 问题 - RAC 环境必须在客户端
/etc/hosts(Linux/macOS)或C:\Windows\System32\drivers\etc\hosts(Windows)中补全全部三类地址:节点名、SCAN 名、VIP 名,且大小写、FQDN 必须与tnsnames.ora完全一致 -
NAMES.DIRECTORY_PATH=(HOSTNAME,TNSNAMES,EZCONNECT)必须显式写进客户端sqlnet.ora,否则即使 hosts 写对了,Oracle 也不会查
监听器日志里反复出现 reverse lookup failed
这是 Oracle 19c 默认行为:每个新连接进来,监听器都会对客户端 IP 做反向 DNS 查询(gethostbyaddr())。若 DNS 不可用、/etc/resolv.conf 为空或配置异常,它会默认等满 30 秒才继续——RAC 多节点+SCAN 场景下,延迟会被放大。
- 在数据库服务器端
$ORACLE_HOME/network/admin/sqlnet.ora中添加:tcp.reverse_dns_checking = no - 确保该文件权限为 644,属主是运行监听器的用户(通常是
oracle) - 执行
lsnrctl reload(单实例)或逐节点srvctl stop listener && srvctl start listener(RAC) - 验证方式:连一次,查
$ORACLE_HOME/network/log/listener.log,不再出现reverse lookup failed或长时间等待日志行
SQLNET.INBOUND_CONNECT_TIMEOUT 设太小导致随机超时
这个参数控制“从 TCP SYN 到完成 Oracle 认证”的总耗时,默认仅 60 秒。RAC 中若监听器正忙于 DNS 查询、ACL 检查或 SSL 协商,60 秒根本不够,就会报 ORA-12170。
- 在所有 RAC 节点的
$ORACLE_HOME/network/admin/sqlnet.ora中显式设置:SQLNET.INBOUND_CONNECT_TIMEOUT = 180 - 不要设为 0(禁用),那会导致拒绝所有慢连接
- 注意:客户端 JDBC URL 中的
connectTimeout=30000对 Oracle Thin 驱动无效(官方明确不支持),别白费力气 - 同时检查是否启用了
tcp.validnode_checking = yes——只要tcp.invited_nodes或tcp.excluded_nodes任一存在,它就自动生效,必须一并注释掉
SCAN VIP 地址冲突或 DNS 负向缓存干扰
SCAN 表现为“有时通、有时不通”,srvctl status scan_listener 显示 running,但 tnsping 超时、应用报 ORA-12541,大概率不是配置错,而是底层网络问题。
- 在每个 RAC 节点执行
ip addr show,确认 SCAN VIP 是作为 secondary 地址绑定,且未被标记为DUP - 用
arping -D -I ens33 10.10.10.44测试地址唯一性;若返回 “Received reply”,说明局域网内已有设备响应此 IP - 客户端上运行
dig rac-scan.example.com @8.8.8.8 +norecurse,绕过本地递归 DNS 直连公网 DNS;若能拿到全部 3 个 A 记录,而本地nslookup只返回一个或超时,就是 DNS 负向缓存惹的祸 - 长期方案是调低 DNS 服务端负向缓存 TTL(如 bind 的
max-ncache-ttl),短期可临时在应用服务器/etc/hosts中静态写入 3 个 SCAN IP(仅限测试)
真正难排查的不是单一参数,而是多个环节叠加:比如 DNS 解析慢 + 反向查询开启 + inbound timeout 还是默认值,三者一碰,就变成“偶发超时”。每次只动一个点,再验证,不然容易误判。











