首批通过分布式安全可靠测评,为关键业务系统打造
分析响应时间突然抖动的 SQL
更新时间:2026-04-10 11:58:35
推荐使用外部诊断工具 Tars 进行问题分析,或者使用 (G)V$OB_SQL_AUDIT 视图进行问题排查。
使用 (G)V$OB_SQL_AUDIT 进行问题排查方式如下:
在线上环境中,如果出现响应时间(Response Time, RT)的突然波动,但这种波动并不是持续的,建议在波动出现后立刻关闭 SQL 审计(通过执行
ALTER SYSTEM SET enable_sql_audit = false;命令),以确保这次波动的 SQL 请求记录在 SQL 审计中。通过 SQL Audit 查询抖动附近那段时间 RT 的 TOP N 请求,分析有异常的 SQL。
找到对应的 RT 异常请求,则可以分析该请求在 SQL Audit 中的记录进行问题排查:
a. 查看是否有很长等待事件耗时。
b. 分析逻辑读次数是否异常多(突然有大账户时可能会出现)。
逻辑读次数 = 2 * ROW_CACHE_HIT
+ 2 * BLOOM_FILTER_CACHE_HIT
+ BLOCK_CACHE_HIT + DISK_READS
如果在 SQL Audit 中 RT 抖动的请求数据已被淘汰,则需要查看 OBServer 节点中抖动时间点是否有慢查询的 Trace 日志,并分析对应的 Trace 日志。