首批通过分布式安全可靠测评,为关键业务系统打造
ob_tenant500_mem_hold_percent_over_threshold OB 500 租户内存占用率超限
更新时间:2026-04-14 15:11:01
告警描述
OBServer 节点上 OB 500 租户(特殊统计,不特指某一个租户)占用 OBServer 节点总内存超过阈值时,触发该告警。
告警原理
下表列出了该告警监控逻辑中涉及的关键参数。
| 参数 | 值 |
|---|---|
| 监控指标 | ob_tenant500_mem_hold_percent 该指标值表示 OceanBase 500 租户占用 OBServer 节点总内存的百分比,其值大于阈值(默认为 95%)时触发告警。 |
| 数据来源 | select sum(hold), sum(used) from __all_virtual_memory_info where tenant_id = 500 and svr_ip = @svr_ip and svr_port = rpc_port();
|
| 采集指标(单位:GB) | mem_hold、mem_total |
| 监控表达式 | 100 * sum(mem_hold{metric_group="tenant500_memory_info",@LABELS}) by (@GBLABELS) / sum(mem_total{metric_group="all_virtual_server_stat",@LABELS}) by (@GBLABELS) |
| 采集周期 | 60 秒 |
规则信息
| 监控指标 | 默认阈值(单位:%) | 持续时间 | 检测周期 | 消除周期 |
|---|---|---|---|---|
| ob_tenant500_mem_hold_percent | 95 | 0 秒 | 60 秒 | 5 分钟 |
告警信息
| 告警触发方式 | 告警等级 | 范围 |
|---|---|---|
| 基于监控指标的表达式 | 严重 | 服务器 |
告警模板
告警概述模板:${alarm_target} ${alarm_name}
告警详情模板:集群:${ob_cluster_name},主机:${host},告警:${alarm_name},内存占用率 ${value_shown}, 超过 ${alarm_threshold} %
告警概述样例:ob_cluster=obcluster-1 OB 500 租户内存占用率超限
告警详情样例:集群:obcluster-1,主机:xxx.xxx.xxx.xxx,告警:OB 500 租户内存占用率超限,内存占用率 96.0 %, 超过 95.0 %
对系统的影响
500 租户内存使用过多会导致机器内存资源耗尽,OBServer 节点内的租户会因为内存不足而无法正常工作。
可能原因
部分已知缺陷会在特定场景下导致 500 租户内存使用持续增长。
处理方法
在 OCP 中进入该 OceanBase 集群 sys 租户的 资源管理 界面,查看 资源使用趋势 中的 内存 折线图,判断内存使用量是否符合预期。

如果内存用量符合预期,可以调整告警项阈值以避免告警持续触发。
可在 系统管理 > 告警 的 告警项配置 页签中找到相应告警,并通过 编辑 按钮修改告警阈值。
如果内存用量不符合预期,则需要重启 observer 进程,以避免 OBServer 节点因内存不够而无法工作。
可在该 OceanBase 集群 总览 页的 OBServer 列表 中单击 重启 按钮,来重启 observer 进程。