首批通过分布式安全可靠测评,为关键业务系统打造
ob_cpu_assigned_percent_over_threshold OB 已经分配给租户的 CPU 占比超限
更新时间:2026-04-14 11:55:54
告警描述
整个 OceanBase 集群中已经指定给租户的 CPU 核心总数,与整个 OceanBase 集群中所有主机的 CPU 核心总数的比值,超过阈值触发此告警。
每个租户在一个 Zone 里面里面可以被分配到多个 Unit(资源单元),每个 Unit 都可以指定可用的 CPU 核心数目的上下限。该告警事件只关注分配是否饱和,并不是真的使用率。
告警原理
下表列出了该告警监控逻辑中涉及的关键参数。
| 参数 | 值 |
|---|---|
| 监控指标 | cpu_assigned_percent |
| 指标来源 | SQL:select /*+ MONITOR_AGENT READ_CONSISTENCY(WEAK) */ cpu_total, cpu_assigned, mem_total, mem_assigned,disk_total, cpu_assigned_percent, mem_assigned_percent from __all_virtual_server_stat where svr_ip = ? and svr_port = ?select /*+ MONITOR_AGENT READ_CONSISTENCY(WEAK) */ cpu_total,cpu_max_assigned as cpu_assigned,mem_total,mem_max_assigned as mem_assigned,disk_total, cpu_assigned_percent, mem_assigned_percent from __all_virtual_server_stat where svr_ip = ? and svr_port = ?select /* MONITOR_AGENT */ cpu_capacity_max as cpu_total,cpu_assigned_max as cpu_assigned,mem_capacity as mem_total,mem_assigned as mem_assigned,data_disk_capacity as disk_total, (cpu_assigned_max / cpu_capacity_max) as cpu_assigned_percent, (mem_assigned / mem_capacity) as mem_assigned_percent from V$OB_SERVERS where svr_ip = ? and svr_port |
| 采集指标 | cpu_assigned、cpu_total |
| 监控表达式 | 100 * avg(ob_server_resource_cpu_assigned{@LABELS}) by (@GBLABELS) / avg(ob_server_resource_cpu{@LABELS}) by (@GBLABELS) |
| 采集周期 | 60 秒 |
监控指标 的值表示已分配给租户的所有 CPU 之和占该 OceanBase 集群内所有 OBServer 节点总 CPU 的比例,当该比例大于阈值(默认为 98%)时触发告警。
说明
- cpu_assigned 表示已分配给租户的所有 CPU 之和。
- cpu_total 表示集群内所有 OBServer 节点的 CPU 之和。
- 表中的监控表达式即表示将以上二者的比值作为监控值。
告警信息
| 告警触发方式 | 告警等级 | 范围 |
|---|---|---|
| 基于监控指标的表达式 | 注意 | 服务器 |
规则信息
| 监控指标 | 默认阈值(单位:%) | 持续时间 | 检测周期 | 消除周期 |
|---|---|---|---|---|
| cpu_assigned_percent | 98 | 0 秒 | 60 秒 | 5 分钟 |
告警模板
告警概述模板:${alarm_target} ${alarm_name}
告警详情模板:集群:${ob_cluster_name},主机:${host},告警:CPU 分配占比 ${value_shown} 超过 ${alarm_threshold} %
告警概述样例:ob_cluster=obcluster-1:svr_ip=xxx.xxx.xxx.xxx OB 已经分配给租户的 CPU 占比超限
告警详情样例:集群:obcluster-1,主机:xxx.xxx.xxx.xxx,告警:CPU 分配占比 99.0 % 超过 98.0 %
对系统的影响
业务需要申请更多资源、或有新的业务需要创建新租户时,可能因为资源不足而无法创建成功。
可能原因
常见于 OceanBase 集群的 CPU 核心数接近完全分配(再分配下去则有 CPU 超分或超卖的可能性)。
处理方法
可通过以下方法增加可用资源:
删除不需要使用的租户 。
删除方法请参见 删除租户。
对实际资源使用小于分配大小的租户进行缩容(调整 Unit 规格) 。
调整方法请参见 Unit 规格管理。
集群扩容。
为该 OceanBase 集群增加 OBServer 节点,方法请参见 添加 OBServer 节点。