基于湖库一体架构,统一管理结构化、半结构化与非结构化等多模态数据,一个系统承载事务处理、实时分析与 AI 工作负载。
OBServer core 在 LogReader
更新时间:2026-06-04 09:56
问题现象
当集群存在归档、备库和 CDC 等高并发读 clog 场景时,有概率会导致 OBServer core。
关键诊断信息
触发条件
存在归档、备库和 CDC 等并发读 clog 场景。
事前巡检
无。
事后诊断
看 core 文件的堆栈,如果堆栈显示以下内容。
oceanbase::palf::LogReader::pread(unsigned long, unsigned long, long, oceanbase::palf::ReadBuf&, long&, oceanbase::palf::LogIteratorInfo*) const at ??:?
oceanbase::palf::LogStorage::inner_pread_(oceanbase::palf::LSN const&, long, bool, oceanbase::palf::ReadBuf&, long&, oceanbase::palf::LogIOContext&) at ??:?
说明遇到该问题。
问题原因
读取日志完成后,会定期10s打印一次读日志相关的监控项,此时可能存在并发问题,一个线程将除数置为 0,另一个线程计算时导致 core。
问题的风险及影响
导致 OBServer core 掉。
影响租户
影响 OceanBase 数据库中的 SYS 租户和 Oracle 租户以及 MySQL 租户。
影响版本
OceanBase 数据库企业版 V4.2.1 GA(oceanbase-4.2.1.0-100000182023092722)及之后版本、V4.2.2 GA(oceanbase-4.2.2.0-100000082024011317)及之后版本、V4.3.0(oceanbase-4.3.0.0-100000072024020200)及之后版本。
解决方法
重新拉起 OBServer。
规避方式
升级至问题已修复版本。目前已修复的版本包括 OceanBase 数据库企业版 V4.2.1 BP9(oceanbase-4.2.1.9-109000092024091919)及之后版本、V4.2.5 GA(oceanbase-4.2.5.0-100000082024102022)及之后版本、V4.3.3 GA(oceanbase-4.3.3.0-100000362024093001)及之后版本。