---
title: "字符序 - OceanBase 数据库 V4.2.4 | OceanBase 文档中心"
description: 字符序 OceanBase 数据库默认的字符序是 utf8mb4_general_ci 。 OceanBase 数据库目前支持的字符序如下表所示。 字符序 所属字符集 说明 utf8mb4_general_ci utf8mb4 使用通用排序规则。 utf8mb4_bin utf8mb4 使用二进制排序规则。 utf8…
---
切换语言

- 中文站 - 简体中文
- International - English
- 日本站 - 日本語

文档反馈![](https://mdn.alipayobjects.com/huamei_22khvb/afts/img/A*P8CuR4UJ_FkAAAAAAAAAAAAADiGDAQ/original) OceanBase 数据库分布式版 - V 4.2.4

# 字符序

更新时间：2024-07-11 00:04:57

[编辑](https://github.com/oceanbase/oceanbase-doc/edit/V4.2.4/zh-CN/700.reference/500.sql-reference/100.sql-syntax/200.common-tenant-of-mysql-mode/100.basic-elements-of-mysql-mode/300.character-set-and-collation-of-mysql-mode/300.collation-of-mysql-mode.md)  

OceanBase 数据库默认的字符序是 `utf8mb4_general_ci`。

OceanBase 数据库目前支持的字符序如下表所示。

| 字符序 | 所属字符集 | 说明 |
| --- | --- | --- |
| utf8mb4_general_ci | utf8mb4 | 使用通用排序规则。 |
| utf8mb4_bin | utf8mb4 | 使用二进制排序规则。 |
| utf8mb4_unicode_ci | utf8mb4 | 使用基于 Unicode Collation Algorithm (UCA) 的排序规则。 |
| utf8mb4_unicode_520_ci | utf8mb4 | 使用 Unicode 5.2.0 版本的排序规则。它遵循 Unicode 码点排序，并忽略字符的大小写差异。 |
| utf8mb4_croatian_ci | utf8mb4 | 使用克罗地亚文（Croatian）的排序规则。`utf8mb4_croatian_ci` 兼容 `utf8_croatian_ci`。 |
| utf8mb4_czech_ci | utf8mb4 | 使用捷克文（Czech）的排序规则。 |
| utf8mb4_0900_ai_ci | utf8mb4 | 使用 Unicode 9.0.0 版本的字符排序规则和顺序，同时忽略了字符的大小写差异，将大写字母和小写字母视为相同的字符。 |
| binary | binary | 使用二进制排序规则。 |
| gbk_chinese_ci | gbk | 使用中文语言排序规则。 |
| gbk_bin | gbk | 使用二进制排序规则。 |
| utf16_general_ci | utf16 | 使用通用排序规则。 |
| utf16_bin | utf16 | 使用二进制排序规则。 |
| utf16_unicode_ci | utf16 | 使用基于 Unicode Collation Algorithm (UCA) 的排序规则。 |
| gb18030_chinese_ci | gb18030 | 使用中文语言排序规则。 |
| gb18030_bin | gb18030 | 使用二进制排序规则。 |
| latin1_swedish_ci | latin1 | 使用瑞典语/芬兰语排序规则。 |
| latin1_bin | latin1 | latin1 使用二进制排序规则。 |
| gb18030_2022_bin | gb18030_2022 | 使用二进制排序规则。 |
| gb18030_2022_chinese_ci | gb18030_2022 | 使用拼音排序规则。不区分大小写。MySQL 模式下该字符集的默认字符序。 |
| gb18030_2022_chinese_cs | gb18030_2022 | 使用拼音排序规则。区分大小写。 |
| gb18030_2022_radical_ci | gb18030_2022 | 使用部首笔画排序规则。不区分大小写。 |
| gb18030_2022_radical_cs | gb18030_2022 | 使用部首笔画排序规则。区分大小写。 |
| gb18030_2022_stroke_ci | gb18030_2022 | 使用笔画排序规则。不区分大小写。 |
| gb18030_2022_stroke_cs | gb18030_2022 | 使用笔画排序规则。区分大小写。 |
| ascii_bin | ascii | 校对规则是基于二进制位比较的。它将字符作为二进制数据进行比较和排序。 |
| ascii_general_ci | ascii | 校对规则是基于字母的不区分大小写的排序规则。它忽略了字符的大小写差异，将大写字母和小写字母视为相同的字符。 |
| tis620_bin | tis620 | 使用二进制排序规则。 |
| tis620_thai_ci | tis620 | 使用泰语排序规则，不区分大小写。 |

#### 说明

- 对于任何 Unicode 字符集，使用 `xxx_general_ci` 排序规则执行的操作比使用 `xxx_unicode_ci` 排序规则执行的操作快。
 - 字符序暂不支持修改。

默认情况下，使用 `SHOW COLLATION` 语句显示所有可用的字符序。

```shell
obclient [(none)]> SHOW COLLATION;

```

返回结果如下：

```shell
+-------------------------+--------------+------+---------+----------+---------+
| Collation               | Charset      | Id   | Default | Compiled | Sortlen |
+-------------------------+--------------+------+---------+----------+---------+
| utf8mb4_general_ci      | utf8mb4      |   45 | Yes     | Yes      |       1 |
| utf8mb4_bin             | utf8mb4      |   46 |         | Yes      |       1 |
| binary                  | binary       |   63 | Yes     | Yes      |       1 |
| gbk_chinese_ci          | gbk          |   28 | Yes     | Yes      |       1 |
| gbk_bin                 | gbk          |   87 |         | Yes      |       1 |
| utf16_general_ci        | utf16        |   54 | Yes     | Yes      |       1 |
| utf16_bin               | utf16        |   55 |         | Yes      |       1 |
| utf8mb4_unicode_ci      | utf8mb4      |  224 |         | Yes      |       8 |
| utf16_unicode_ci        | utf16        |  101 |         | Yes      |       8 |
| gb18030_chinese_ci      | gb18030      |  248 | Yes     | Yes      |       2 |
| gb18030_bin             | gb18030      |  249 |         | Yes      |       1 |
| latin1_swedish_ci       | latin1       |    8 | Yes     | Yes      |       1 |
| latin1_bin              | latin1       |   47 |         | Yes      |       1 |
| gb18030_2022_bin        | gb18030_2022 |  216 |         | Yes      |       1 |
| gb18030_2022_chinese_ci | gb18030_2022 |  217 | Yes     | Yes      |       1 |
| gb18030_2022_chinese_cs | gb18030_2022 |  218 |         | Yes      |       1 |
| gb18030_2022_radical_ci | gb18030_2022 |  219 |         | Yes      |       1 |
| gb18030_2022_radical_cs | gb18030_2022 |  220 |         | Yes      |       1 |
| gb18030_2022_stroke_ci  | gb18030_2022 |  221 |         | Yes      |       1 |
| gb18030_2022_stroke_cs  | gb18030_2022 |  222 |         | Yes      |       1 |
| utf8mb4_croatian_ci     | utf8mb4      |  245 |         | Yes      |       8 |
| utf8mb4_unicode_520_ci  | utf8mb4      |  246 |         | Yes      |       8 |
| utf8mb4_czech_ci        | utf8mb4      |  234 |         | Yes      |       8 |
| ascii_general_ci        | ascii        |   11 | Yes     | Yes      |       1 |
| ascii_bin               | ascii        |   65 |         | Yes      |       1 |
| tis620_thai_ci          | tis620       |   18 | Yes     | Yes      |       1 |
| tis620_bin              | tis620       |   89 |         | Yes      |       1 |
| utf8mb4_0900_ai_ci      | utf8mb4      |  255 |         | Yes      |       1 |
+-------------------------+--------------+------+---------+----------+---------+
28 rows in set

```

字符序具有以下一般特征：

- 两个不同的字符集不能有相同的字符序。
 - 每个字符集都有一个默认的字符序。`SHOW CHARACTER SET` 语句指示每个字符集的默认字符序。`SHOW COLLATION` 语句有一列指示每个字符序是否是其字符集的默认值（如果是则为 Yes，否则为空）。
 - 字符序名称以与它们相关联的字符集的名称开头，通常后跟一个或多个表示其他字符序特征的后缀。

 上一篇 下一篇 ![有帮助](https://gw.alipayobjects.com/mdn/ob_asset/afts/img/A*y6ocSqN8cqsAAAAAAAAAAAAAARQnAQ)![无帮助](https://gw.alipayobjects.com/mdn/ob_asset/afts/img/A*BG9IQJyLHF8AAAAAAAAAAAAAARQnAQ)![反馈](https://gw.alipayobjects.com/mdn/ob_asset/afts/img/A*eTWdQKCRKHwAAAAAAAAAAAAAARQnAQ)[AI](https://www.oceanbase.com/obi) 咨询热线
