首批通过分布式安全可靠测评,为关键业务系统打造
What's New
更新时间:2025-11-25 17:56:05
OceanBase V4.4.1 作为存算分离架构的第二个 LDS 版本,在多个维度实现了显著提升。在共享存储架构方面,进一步增强日志服务能力,支持水平扩缩容以支撑大量日志流的写入负载。SYS 租户支持单副本部署,解决了额外资源占用问题的同时简化运维。新增 Azure Blob 支持,扩展多云部署能力。OBKV-HBase 也针对共享存储模式进行了专项性能优化。
V4.4.1 版本也对向量检索能力进行了升级,支持 Hybrid Search 混合检索,提升召回效果。新增 AI function 能力,支持 SQL 访问大模型。此外通过适配 ARM 架构、无主键表优化、IVF 索引优化等手段进一步提高向量检索的性能。新增视图展示向量索引内存占用和异步任务状态,提升易用性。
V4.4.1 版本全面优化外表查询、旁路导入、存储层读写、PL 硬解析、UDF 执行、SQL 硬解析、Batch DML 及 DDL 性能。PL 硬解析耗时降低 14%,UDF 性能提升 15%-26%,旁路导入排序算法升级显著提升导入效率。
在兼容性方面,V4.4.1 版本在 MySQL 租户模式新增 Python UDF。在 Oracle 租户模式下,支持了 UTL_HTTP 系统包及 DBMS_PLSQL_CODE_COVERAGE 系统包。在安全方面,支持了 RPC 传输加密支持国密以及 TLS 免密登录能力。
V4.4.1 版本支持手动备份数据清理、设置执行备份任务的节点范围、消费归档日志适配强关归档场景。此外支持了 HMS Catalog、OBCDC 支持同步备租户、LOB 大对象的前镜像输出、外表支持 JDBC 插件、备库支持 flashback 接入新主库、SQL 关键字限流、Database 下用户表的聚合、基于 I/O 负载的自适应仲裁等关键能力。
本篇文章主要为您介绍 OceanBase V4.4.1 的一些关键功能特性以及主要的性能提升。
关键特性说明
内核增强
备份恢复增强
V4.4.1 版本对物理备份恢复功能做进一步的增强:备份清理引入了灵活的手动清理能力,支持用户按需删除指定备份集或归档片段,同时保留了自动清理机制。详情请参见手动触发备份的过期清理和手动清理指定的备份或归档数据。这种双轨并行的设计大幅提升了备份管理的灵活性和精细度。针对强关归档场景,对消费归档日志做了适配处理,支持区分
force stop round,进而能够让物理恢复/备库/CDC 等模块在消费归档日志时可以正确定位归档轮次和消费日志。此外,新版本支持用户设置用于执行备份任务的节点范围,同时限制备份及归档模块可访问备份/归档介质的节点范围,避免备份带来的流量占用相对珍贵的跨地域网络带宽,降低备份对业务正常运行带来的影响。详情请参见备份路径和归档路径源端配置案例。OBCDC 同步备租户
备库是 OceanBase 高可用体系中的重要组成,OceanBase 从 V4.1.0 版本开始支持备租户,作为生产租户(主租户)的备份,在主租户发生故障无法提供服务时,可以将备租户切换为主租户对外提供服务,减小数据库不可用时间,提供容错能力。OBCDC 以事务为单位,将 OceanBase 内增量事务数据格式化输出给下游组件消费。通过支持从备租户同步数据,解决如下场景的需求:
- 消费本地数据库数据的需求:消费 OBCDC 数据的应用和数据库主租户异地,业务优先考虑从本地的备租户中消费增量事务数据。
- 主备租户切换后消费备租户数据。在主备租户切换后,OBCDC 可以切换为消费备租户链路,避免数据链路中断。
- 通过消费备租户减小对主租户可能产生的影响,保障主租户的业务稳定性。
OBCDC 支持行外 LOB 前镜像输出
V4.4.1 完善了行外 LOB 数据的前镜像输出,解决了
delete语句、update主键语句、update lob列行外存储转为行内存储、update非 LOB 列时被更新行中 LOB 列前镜像不完善的问题。支持 HMS Catalog
新版本支持了 Iceberg 数据湖开放表格式,同时支持通过 HMS Catalog 查询 Iceberg 表格式的外表和 Hive 表格式的外表。引入 HMS Catalog 旨在构建与 HMS 协议兼容的统一元数据抽象层,通过自动同步多表格式元数据(如 Hudi Timeline、Iceberg Snapshots)、无缝对接主流计算引擎,解决跨系统元数据歧义问题,是让 OceanBase 具备数据湖从“存算分离”的能力迈向“元数据驱动治理”的关键基础设施。
统计信息增强
OceanBase V4.4.1 针对超大分区等资源消耗场景提升收集稳定性,加速列存场景收集速度。优化措施包括大分区表渐进收集、通过维护分区统计信息来加速全局统计信息、调整
SkipRate收集逻辑为最大收集 100 个最大行数的分区等。外表支持 JDBC 插件
用户可以通过外表直接访问外部数据源,比如通过外表访问存储在 OSS 上的 CSV 文件、访问 ODPS 数据。V4.4.1 版本支持通过外表 JDBC 插件访问 JDBC 支持的数据源,本版本支持 MySQL 数据源,其他数据源将在未来迭代支持。
备库支持 flashback 接入新主库
V4.4.1 之前的版本中,如果是一主一备的部署模式,主库不可用,备库 Failover 成主库之后。当用户需要为新主库搭建一个备库时,如果新主库的日志还没有被回收,可以创建一个空的网络备租户,从零开始同步日志。如果新主库的日志已经被回收了,则只能先让新主库物理备份并归档日志,然后基于物理备份恢复出来一个备租户。如果是一主多备的部署模式,主库发生故障时,其中一个同步位点较大的备库将 Failover 成主库,在老版本中另一个备库只能作废,需要给新主库重新搭建一个备库。整个新备库的创建流程十分复杂。V4.4.1 版本中备库支持 flashback 接入新主库,一主多备的部署模式,当主库发生故障时,其中一个同步位点较大的备库将 Failover 成主库。通过日志 flashback 运维命令,可以将同步位点较小的主库接入新备库。一主一备的部署模式,利用旧主备份搭建一个备库,通过日志 flashback 运维命令,可以将这个备库接入新主库。
共享存储增强
SYS 租户单副本部署
V4.4.1 版本支持了 SYS 租户单副本部署,以及在整个集群宕掉的情况下恢复 SYS 租户的能力。该特性解决了 SYS 租户多副本部署的额外的资源占用问题,同时简化系统部署运维的复杂度。
日志服务增强
V4.4.1 版本进一步提升日志服务能力,支持了水平扩缩容能力以支撑大量日志流的写入负载,增加反馈式日志聚合方式降低了低频写入日志场景下的延时,优化 CLOG 日志回收位点计算方式降低了 rebuild 的发生概率。同时完成 CDC 与日志服务的适配,共享存储模式下支持通过 CDC 向下游同步数据。在可观测性方面,通过视图
CDB_OB_SPACE_USAGE展示租户级对象存储的使用统计信息。对象存储支持 Azure Blob
支持使用 Azure Blob 协议访问 Azure Blob 对象存储 。用户可使用 azblob://path 表示通过 azure blob 协议访问对象存储。
MySQL 兼容性增强
Python UDF
OceanBase v4.4.1 版本上支持了 MySQL 模式的 Python UDF。通过支持 Python UDF,可以将大量 Python 生态产品融入 OceanBase,提升 UDF 的开发效率。此外,实现高度兼容 ODPS,用户仅需少量改动即可复用已有的 ODPS Python 脚本,增强了 OceanBase 在 AP 等场景的竞争力。
Oracle 兼容性增强
UTL_HTTP 系统包
V4.4.1 版本新增支持了
UTL_HTTP系统包,支持在 PL/SQL 中通过 HTTP 协议获取网络数据,支持了begin_request、end_request、get_response、end_response、read_line、read_raw、read_text、write_line、write_raw、write_text、set_transfer_timeout、get_transfer_timeout等 12 个函数。
OBKV/多模数据增强
OBKV 增强
- 在 OBKV-Table 中支持 Json 数据类型,目前仅支持 Json 文本的读写,不支持相关的 Json 表达式。详情请参见OBKV-Table。
- OBKV-HBase 的大多数场景都是 IOT 的场景,数据量都在 PB 级别,用户会选择用共享存储来降本,IOT 的场景写多读少,且偏向于读热数据,为了满足用户需求,新版本 OBKV-HBase 支持在共享存储模式下指定热分区进行查询等能力。
- 此外 OBKV-Table 支持堆组织表,解决了写入流程中主键冲突和转储合并耗费了大量的 I/O 带宽的问题。详情请参见OBKV-Table 数据模式。
半结构化编码优化
V4.4.1 版本对半结构编码功能进行了优化,进一步降低了 JSON 数据存储所需的存储空间,提升了查询和导入性能,并提供通过表级属性
semistruct_properties设置freq_properities来控制频繁列阈值。详情请参见半结构化编码。全文索引增强
新版本针对针对 AI Search 场景,即 RAG 和混合检索场景,优化了全文索引功能及性能。通过稀疏检索裁剪优化及无主键表优化提升全文索引的性能,并支持了 ElasticSearch 在混合检索场景下的若干常用功能点,参考 ES 的 SQL,接入 OceanBase 的 SQL 语法,包括:field 权重、token 权重、
mininum_should_match、boost、multi_match、归一化等。
向量检索增强
IVF 索引优化
新版本通过增加对 IVF 聚类中心、码表的缓存,以及减少查询流程中的内存消耗,提升查询性能;通过并行化处理 IVF 索引构建,提升构建性能;新增 nbits 参数指定 PQ 量化的 Kmeans 聚类中心个数,同时完善 IVF 索引对 cosine、ip 距离算法支持。详情请参见创建向量索引。
小规格向量检索优化
V4.4.1 版本提升小规格下基于内存的 HNSW 索引性能。
混合检索(Hybrid Search)
新版本支持了混合检索能力。混合检索是指同时进行基于向量的语义搜索及基于全文索引的关键词搜索,再将两者检索结果进行综合排序,以提供更准确的搜索结果。其必要性在于向量检索仅提供语义上的近似检索能力,对于关键字特别是数字,专有名词等的匹配效果不优,全文搜索能可以弥补这部分缺失,两者结合使用可实现更优的检索效果。详情请参见混合检索。
AI 函数(AI Function)服务
AI Function 是通过 SQL 表达式来使用 AI 模型直接处理存储与数据库内的数据。它能极大的简化使用用 AI 大模型对数据进行分析,总结,特征提取等流程的复杂度。新版本新增了
DBMS_AI_SERVICEPL 包,用于管理 AI FUNCTION 使用到的模型,并新增 AI MODEL 权限管理的相关命令,同时新增三个 AI FUNCTION 表达式(AI_COMPLETE/AI_EMBED/AI_RERANK),通过构造各个厂商的消息格式,借助 HTTP API 实现 SQL 直接访问大模型。详情请参见AI 函数服务。
性能提升
PL 性能优化
V4.4.1 版本通过优化硬解析阶段构造 Recordtype 的热点开销以及 package 编译场景内存使用等措施对 PL 硬解析性能进行了优化,优化后部分包如 PKG_BUSINREVERSE 的解析耗时从 2.8s 降到了 2.4s,提升 14% 左右。
SQL 硬解析优化
此外,V4.4.1 版本在 Merge Join 路径裁剪、表达式 Formalize 效率提升、去重热点、location cache 批量刷新、动态采样 Plan Cache 命中等方面进行了多项优化,从解析时间和内存占用两大维度显著提升了超复杂 SQL 的硬解析性能。在处理大数据量插入(如插入数千万行的
INSERT)、深度嵌套的AND/OR谓词、包含上百个UNION分支或上千分区查询等复杂场景时,优化效果尤为明显。Multi Get 性能优化
新版本通过列存扫描支持使用行存投影、keep order 扫描支持 blockscan、行存格式下压 filter 支持向量化、keep order 扫描支持 blockscan 等优化措施,提升了回表查询性能,尤其对于数据量比较大的场景下提升较为明显,对行列冗余的宽表投影多列(大于 80 列)的场景也有较明显的性能优化效果,此外也提升向量化 nest loop join 场景下的扫描性能。
分布式执行性能优化
新版本通过全局索引回表优化、List 分区裁剪优化、分布式场景下的 GTS 访问优化等手段显著提升了分布式执行场景性能。
安全强化
RPC 传输加密支持国密
V4.4.1 版本支持对
ssl_external_kms_info配置项中 SCENE 标识为 'ANT_SM',从而指定 RPC 通信使用国密加密算法。TLS 免密登录
V4.4.1 新增支持了 TLS 免密登录,提供了 SYS 租户或特性用户缺失或不设置登录密码情况下的安全解决方案,同时可解决生态组件访问 OceanBase 数据库需创建特定账户的问题。
易用性提升
Database 下用户表的聚合
- V4.4.1 版本支持 Database 下用户表的聚合,基于 sharding none 表组,支持了同一 Database 用户表自动聚合、多 database 用户表聚合。此外支持了 sharding none 表组权重均衡,支持自动聚合的 database 按权重分布。详情请参见表组权重均衡应用案例。
- 同时新增支持基于权重的分区均衡能力,用户可对分区指定权重值,在此基础上分区均衡算法通过分区移动和分区交换的方式,使各个用户日志流上分区权重之和的方差尽量小,进而将业务流量打散。详情请参见设置分区权重。
- 此外均衡任务触发的 Transfer 或迁移操作对前台业务可能会产生一定的影响,为了方便在特定时刻进行运维操作,新版本支持了暂停、恢复均衡任务的功能。详情请参见暂停和恢复 Balance Job。
- 新版本支持了手动创建日志流的命令,通过单独创建日志流并手动 transfer 分区满足需要单独指定表或分区的 primary zone 的场景需求。详情请参见创建日志流。
SQL 关键字限流
SQL 关键字限流支持按用户、IP、数据库、表、SQL 类型(DML)和关键字组合进行限流,提供规则级别和 SQL 级别两种粒度的限流方式。该功能可防止特定 SQL 语句过度消耗资源、避免因资源不足导致的查询超时以及应对突发流量和异常 SQL 访问,保证核心业务不受干扰。
相关文档
本篇文章主要向您介绍了重点的新增功能、关键特性等,如果想要了解更多版本详情以及其他各版本信息,请关注我们的版本发布记录: