基于湖库一体架构,统一管理结构化、半结构化与非结构化等多模态数据,一个系统承载事务处理、实时分析与 AI 工作负载。
OceanBase AP 概述
更新时间:2026-04-10 12:01:00
OceanBase AP 是什么
OceanBase 是一款完全自研的企业级原生分布式数据库,在普通硬件上实现金融级高可用,首创“三地五中心”城市级故障自动无损容灾新标准,刷新过 TPC-C 标准测试世界纪录,单集群规模超过 1500 节点,具有云原生、强一致性、高度兼容 Oracle/MySQL 等特性。在 V4.3.x 版本中,OceanBase 数据库集中优化了分析处理(AP)场景,并实现了事务处理(TP)与分析处理(AP)的结合。此次更新依托 OceanBase 的 LSM-Tree 架构,实现行存列存存储一体化,同时推出了基于列存的全新向量化引擎以及代价评估模型。通过这些功能强化,大幅提升处理宽表的效率,显著增强了 AP 场景下的查询性能,同时也支持实时导入、二级索引、高并发主键查询等实时 OLAP 常见需求。

核心优势
稳定可靠
- TP、AP 一体化构建,金融核心交易系统证明的稳定性。
- 业内首创的三地五中心可支撑城市级无损容灾,全球领先的 RPO = 0,RTO 小于 8 秒故障自动恢复能力,满足严苛条件下的业务连续性。
高性能分析
- OceanBase 数据库支持列存和行列混存,以及多种查询优化手段,保障良好的查询性能。此外,OceanBase 数据库 V4.3 版本中实现了向量化引擎 2.0,通过对数据格式,算子实现优化及存储向量化优化等大幅提升了向量化引擎执行性能。
- Ad-hoc 查询性能与 ClickHouse 相当。
- TPC-H 30000GB 第一。
低成本&易管理
- HTAP 混合负载,一套系统代替原来 TP+AP 两套系统,无需分库分表。
HSAP
- 分析结果直接提供在线数据服务。
多模
- 支持用 SQL 对 JSON、GIS、文本等非结构化数据进行分析。
应用场景
场景一:实时报表和实时风控
存在这样一种数据库用法:绝大部分场景下,数据库里都是 OLTP 负载,少数时候会有一些 OLAP 负载。这种场景下,专门购买一个 AP 集群来做分析是非常不经济的,此时,可以采用 OceanBase 数据库行列混合副本,或者在行存副本上建立列存索引。在行格式上做 TP、在列格式上做 AP,并通过资源组做软隔离。
在行存的基础上,通过创建列存索引的方式,在集群内即可获得列存的能力,实现查询加速。行存和列存在同一个集群内,共享同一套资源,有资源隔离的需求,同一个租户内部提供了 cgroup 隔离,CPU、IO 等的隔离,TP 和 AP 之间互不干扰。
- TP 用行存
- AP 用列存索引(降低存储开销)
- 隔离用资源组

场景二:轻量级实时数仓
OceanBase 数据库基于列存、并行执行引擎、向量化引擎、基于改写和代价的优化器,具备担任轻型数仓的能力。数仓场景可以全部使用 OceanBase 数据库来简化 ETL。通过物化视图来简化 ETL,同时也可以支持 Flink,Flink query 可以继续使用,不需要修改,把 OceanBase 数据库当做存储来用。OceanBase 数据库可以去订阅 ODS 的日志实时做流式计算,结果写到 ODS 里对外提供交互查询和联邦查询。
- AP 用列存
- TP 用行存索引(加速 AP 点查)
- 隔离用资源组


场景三:Serving 场景
Serving 场景是指那些要求快速响应、低延迟地处理和分析数据,以支持即时决策和交互式数据探索的场景。通常采用列式存储来加速聚合操作,利用索引减少数据检索时间,并借助分布式计算框架横向扩展,处理大规模数据集。
为了提升 Serving 的性能,业务上通常将结果预连接好,形成大宽表存储数据库中,然后在这个大宽表上执行高并发的单表聚合操作。
OceanBase 数据库可用于替换 ClickHouse 用于 Serving 场景。

技术架构
- 关于 OceanBase 数据库的技术架构介绍,参见 OceanBase 系统架构。
- 关于 OceanBase 数据库技术原理的详细介绍,参见 OceanBase 系统原理 章节。