OceanBase
  • 产品
  • 解决方案
  • 客户
  • 合作伙伴
  • 资源与服务
  • 文档
  • 社区
云控制台登录 / 注册
  • 免费试用
本地部署
OceanBase 分布式数据库

首批通过分布式安全可靠测评,为关键业务系统打造

OceanBase 集中式数据库

集中式架构,兼具性能与成本优势的集中式数据库

OceanBase 社区版

兼容 MySQL 的单机分布式一体化开源数据库

OceanBase seekdb

为现代 AI 应用打造的开源混合搜索数据库

云上部署
OB Cloud

一体化云数据库,打造面向多云的一致性体验

一体机
OceanBase 数据库一体机

软硬一体,提供极致性能与高可靠性保障

OceanBase AI 一体机

基于 OceanBase AI Stack 的智能一体机

工具
迁移评估工具(OMA)
数据迁移工具(OMS)
开发者工具(ODC)
运维管理工具(OCP)
自治服务工具(OAS)
一体化关键能力
TP 事务处理

面向关键业务负载的事务处理能力,保障大规模业务稳定运行与数据零丢失

AP 实时分析

原生支持事务与分析融合,低延迟洞察业务数据,驱动智能决策与敏捷运营

AI 现代负载

湖库一体管理多模态数据离在线处理,AI 原生支撑 Agent 规模化应用

oceanbase白皮书

OceanBase 一体化分布式数据库

通用场景
全场景业务系统 OLTP
实时分析混合负载
异地多活
多基础设施部署
一站式传统数据库升级
混合云部署
一库多芯软硬件混合部署
分布式数据库单机部署
大存储类数据库降本
冷数据归档降本
多实例资源整合
分库分表一体化升级
高并发场景
数据中台
行业解决方案
国有大行和股份制银行核心系统解决方案
区域性银行核心系统解决方案
寿险核心系统解决方案
产险核心系统解决方案
资管交易类系统解决方案
资管 TA 清算类系统解决方案
运营商核心系统解决方案
人社核心系统解决方案
电力核心系统解决方案
行业专区
银行专区

助力银行完成各类核心业务系统升级

保险专区

寿险、产险核心系统升级的更佳选择

零售专区

助力200+零售行业客户规模化落地

DB 大咖说
oceanbase爱奇艺

百亿级卡券业务的“单库双擎”架构升级

oceanbase四川银行

800个测试用例选定分布式数据库

oceanbase太平洋保险

先难后易,核心系统数据库升级复盘

行业案例
oceanbase交通银行

核心数据库的“分布式革命”

oceanbase中国移动

B域核心CRM&BOSS近乎零改造分布式升级

oceanbase理想

打造领先的智能制造系统和自动驾驶体验

演讲实录
oceanbase中国联通

集团应用分布式数据库覆盖B/O/M域

oceanbase国泰海通

智能推送系统稳定支撑单日亿级消息处理量

oceanbase中国联合航空

中国首款机票盲盒背后的数据库力量

用户实践
oceanbase北京银行

最快速度完成40余套系统国产数据库升级

oceanbase维沃移动通信有限公司

替换 MySQL 分库分表,探索成本效益最优

oceanbase滴滴

数据库大规模运维体系建设及落地实践

合作伙伴
合作伙伴类型
联合解决方案
产业生态伙伴
经销商伙伴
技术服务伙伴
培训认证伙伴
生态联合解决方案
神州信息 x OceanBase 银行核心系统
长亮科技 x OceanBase 新核心系统
中电金信 x OceanBase 金融分布式核心系统
天阳科技 x OceanBase 贷记卡方案
易诚互动 x OceanBase 手机银行方案
恒生 x OceanBase UF3.0/O45/TA/估值方案
商业发行版
云树®数据库软件 ActionDB
服务
支持与服务
提交工单
软件下载
OceanBase 企业版
OceanBase 社区版
OB Cloud
学习
培训与认证
在线课堂
在线体验
开发者
开发者中心
资料
行业报告与白皮书
官方博客
年度发布会资料
开发者大会资料
oceanbase白皮书

金融核心系统数据库升级路径与场景实践

oceanbase白皮书

人社关键业务数据库一体化升级实践

产品文档
oceanbaseOceanBase 数据库
驱动和中间件
oceanbaseOB Cloud 云数据库
工具与组件
oceanbaseOceanBase 数据库一体机
生态商业产品
快速上手
OceanBase 数据库
OB Cloud 云数据库
知识库
汇聚常见产品使用问题案例
在线体验

Demo与实验,感受 OceanBase 的核心能力与应用场景

OceanBase 最佳实践
了解 OceanBase 分布式数据库的架构与系统原理
技术博客

技术解析 | 用户实践 | 社区月报

在线课堂

电子书 |视频课程|在线培训

Developer Hub
应用开发Demo | 数据开发与集成工具
问答论坛

快速答疑 | 常见问题 | 技术交流

社区活动

Meetup | 技术公开课

GitHub

查看源码 | 贡献代码 | 建议反馈

加入社区

社区组织 | 社区用户贡献 |开发者贡献

进入社区首页
oceanbase数据库大赛

第五届OceanBase数据库大赛

oceanbase免费课程
从故障处理到性能调优:OceanBase资深DBA进阶培训
切换语言
  • 中文站 - 简体中文
  • International - English
  • 日本站 - 日本語
文档反馈
  1. 文档中心
  2. OceanBase 云平台
  3. V4.3.3
  4. 参考指南
  5. 告警参考
  6. OAS 告警
  7. os_tsar_nvme_ioawait OBserver 节点 NVMe 磁盘 ioawait 高
V4.3.3
  • 文档概览
  • 产品简介
  • 部署 OceanBase 云平台
  • 升级 OceanBase 云平台
  • 快速入门
  • 集群管理
  • 租户管理
  • OBProxy 管理
  • Binlog 服务管理
  • 主机管理
  • 告警中心
  • 监控大盘
  • 性能监控
  • 诊断调优
  • 运维管理
  • 备份恢复
  • 容灾管理
  • 日志服务
  • 软件包管理
  • 系统管理
  • SQL 调优实践
  • 运维最佳实践
  • 参考指南
    • 告警参考
      • 概述
      • OceanBase 告警
      • 应用告警
      • OAS 告警
        • os_cpu_irq_error 服务器 CPU 软中断未打散
        • os_tsar_cpu_sys_abnormal 服务器 CPUSYS 使用率过高
        • os_observer_fd_usage OB server 打开句柄过多
        • os_tsar_cpu_util_full 服务器 CPU 使用率爆满
        • os_tsar_cpu_util_hwm 服务器 CPU 使用率超限
        • os_kernel_io_hang OB server 服务器 IO Hang
        • os_tsar_sda_ioawait OB server 服务器磁盘 ioawait 过高
        • os_tsar_nvme_ioawait OBserver 节点 NVMe 磁盘 ioawait 高
        • os_tsar_traffic_drop 服务器网络丢包过多
        • os_tsar_traffic_error 服务器网络收发包出错
        • os_observer_core_dump OBserver Core Dump
        • os_nic_1000m_full 服务器千兆网卡被打满
        • os_nic_1000m_hwm 服务器千兆网卡高水位
        • os_tsar_traffic_overload 服务器网卡使用率过高
        • node_file_root_usage 服务器根目录使用率过高
        • node_file_inode_usage 服务器 inode 使用率过高
        • os_kernel_ntp_down 服务器 NTP 服务不存在
        • os_kernel_ntp_delay 服务器 NTP 不同步
        • node_memory_peak 内存使用率过高
        • os_home_file_usage 服务器 home 目录磁盘使用率超限
        • node_file_data1_usage OB 数据盘磁盘使用率过高
        • node_file_datalog1_usage OB 日志盘使用率过高
        • sql_audit_collect_lost_percent_over_threshold 采集丢点率超限告警
      • 附录
    • API 参考
    • 监控指标参考
    • 信息采集参考
    • 错误码参考
  • 常见问题
  • 附录
  • 版本发布记录
  1. 文档中心
  2. OceanBase 云平台
  3. V4.3.3
  4. 参考指南
  5. 告警参考
  6. OAS 告警
  7. os_tsar_nvme_ioawait OBserver 节点 NVMe 磁盘 ioawait 高

os_tsar_nvme_ioawait OBserver 节点 NVMe 磁盘 ioawait 高

更新时间:2026-04-14 15:16:08

github-fill编辑
编组分享

告警描述

磁盘 IO 的几个重要指标中:

  • svctm 反映磁盘的性能,一般小于 20 ms。
  • ioawait 反映 IO 的处理效率,ioawait 越低,越说明 IO 队列不拥塞,ioawait 接近于 svctm,说明 IO 几乎不等待(ioawait 略大于 svctm 是可接受的)。
  • io_util 为单位时间内设备 IO 占比,反应 IO 忙线程度。
  • io_qusize 为 IO 队列长度,当队列长度越大,ioawait 可能越高。

连续 30 秒 io_await ≥ 20 ms、io_util ≥ 98% 且 io_qusize ≥ 20 则触发该告警。

告警原理

参数 值
监控指标 io_util, io_qusize, io_await
指标来源 主机基础监控,采集自 node_exporter
类比命令 iostat -dx 结果中的指标:util(io_util),avgqu-sz(io_qusize),await(io_await)
采集指标 io_util, node_disk_io_time_weighted_seconds_total, io_await
监控表达式
  • io_util: avg(io_util{@LABELS}) by (@GBLABELS)
  • io_qusize: sum(delta(node_disk_io_time_weighted_seconds_total{@LABELS}[@INTERVAL])) by (@GBLABELS)
  • io_await: avg(io_await{@LABELS}) by (@GBLABELS)
  • 采集周期 1 秒

    规则信息

    监控表达式 监控指标含义 默认阈值 检测周期 消除周期
    io_await > 20 and io_util >= 98 and io_qusize >= 20
  • io_util:单位时间内磁盘处理 IO 的时间占比,计算公式:(r/s + w/s) * svctm/1000,即每秒读写次数乘以处理耗时占比。
  • svctm:设备 IO 响应耗时 (毫秒)。
  • io_await:设备 IO 等待耗时(毫秒)。
  • io_qusize: IO 队列长度。
  • io_util: 98%
  • io_await: 20ms
  • io_qusize: 20
  • 10 秒 5 分钟

    告警信息

    告警触发方式 告警等级 范围
    基于监控指标的表达式 严重 服务器

    告警模板

    • 告警概述
      • 模板:${alarm_target} ${alarm_name}
      • 样例:ob_cluster=obcluster-1631964370:svr_ip=xxx.xxx.xxx.xxx:device=dm-0 OBserver NVMe 磁盘 ioawait 过高
    • 告警详情
      • 模板:集群:${ob_cluster_name},主机:${host},告警:${alarm_name},OB 磁盘:${ob_device},device ${device},io await ${io_await_value_zh_cn} 超过 ${io_await_alarm_threshold} ms,io util ${io_util_value_zh_cn} 超过 ${io_util_alarm_threshold} %,io qusize ${io_qusize_value} 超过 ${io_qusize_alarm_threshold}。
      • 样例:集群:obcluster-1,主机:xxx.xxx.xxx.xxx,告警:OB server NVMe 磁盘 ioawait 高,OB 磁盘:ob_log,device dm-0,io await 30 毫秒 超过 20 毫秒,io util 99 % 超过 98 %,io qusize 33 超过 20。

    对系统的影响

    IO util 大于 98% 时说明 IO 设备满负荷运行;若 ioawait 大于 20 ms,可能是磁盘设备处理效率低或有大量 IO 请求,此时会影响转储、合并操作的进度。

    OB 磁盘分为数据盘(/data/1)、日志盘(/data/log1)、安装盘(/home),该告警针对数据盘和日志盘生效。当数据盘和日志盘出现 IO 异常时,将影响 OBServer 节点服务。

    可能原因

    1. 磁盘性能较差。
    2. CPU 性能较差,无法处理大量的 IO 请求。
    3. 存在高并发 IO 请求。

    处理方法

    1. 排查是否为磁盘、CPU 性能差引起的,此问题可通过升级硬件资源来规避。

    2. 确认请求流量是否符合预期,并排查 IO 异常的原因:

      # 查看 IO 统计信息
      iostat -dx
      
      # 查看 IO 高的进程
      iotop
      
      # 查看进程有哪些文件被写入,写入量是否符合预期等
      lsof -p <pid>
      

    本文目录

    告警描述告警原理规则信息告警信息告警模板对系统的影响可能原因处理方法
    有帮助
    无帮助
    反馈
    AI

    OceanBase

    OceanBase 海扬数据库始创于 2010 年,是完全自主研发的数据库公司。2020年开始独立商业化运作,历经15年大规模核心场景验证,目前是中国数据库的领军企业之一。从分布式数据库到 AI 数据库,为企业提供安全、稳定、可扩展的数据底座,推动数据基础设施全面拥抱 AI 时代。

    关于我们

    关于 OceanBase最新动态资质荣誉客户专家委员会招贤纳士合作伙伴年度发布会开发者大会

    资源与服务

    支持与服务文档知识库软件与工具下载培训与认证在线体验数据库专题视频

    社区

    快速上手开发者中心博客活动学习问答GitHub

    数据库百科

    分布式数据库国产数据库OLTP 数据库OLAP 数据库HTAP 数据库数据库向量数据库向量检索

    联系我们

    服务热线:
    400-109-0633
    商务咨询
    培训认证技术支持媒体合作
    京公网安备11010802047223号京公网安备11010802047223号
    京ICP备20024574号-1
    合字B1.B2-20250395
    网站服务协议隐私协议安全响应协议
    OceanBase 版权所有 © 2026 基础资源和备案服务由阿里云提供