MySQL学习-字符串属性

本文涉及的产品
云数据库 RDS MySQL,集群系列 2核4GB
推荐场景:
搭建个人博客
RDS MySQL Serverless 基础系列,0.5-2RCU 50GB
云数据库 RDS MySQL,高可用系列 2核4GB
简介:

二进制字符串的比较是通过逐个字节的比较字节数值来进行的。二进制字符串不和字符集相关联。

非二进制字符串是一个Collation列,他存放包含特定字符集和Collation的文本,字符集规定了能够存入字符串的文本,而Collation则规定了对字符进行比较和排序的时候的特性。

所以说非二进制字符串的特征之一就是他们有一个字符集。

如果想查看系统中有哪些字符集的话库银使用下面的命令:

show character set;

输出的结果很长,我截取了一些:

+----------+-----------------------------+---------------------+--------+
| Charset  | Description                 | Default collation   | Maxlen |
+----------+-----------------------------+---------------------+--------+
| big5     | Big5 Traditional Chinese    | big5_chinese_ci     |      2 |
| dec8     | DEC West European           | dec8_swedish_ci     |      1 |
| cp850    | DOS West European           | cp850_general_ci    |      1 |
| hp8      | HP West European            | hp8_english_ci      |      1 |

有些字符集只包含单字节字符,而有些字符集包含多字节字符。有些多字节字符集中的字符有固定数目的字节来表示,但是有些多字节字符集中的字符长度却是可变的。比如unicode使用ucs2字符集来保存,其中的字符都占2个字节,也可以使用utf-8字符集来表示,其中的每个字符都占用一个到3个字节不等。

我们可以使用LRNGTH()和CHAR_LENGTH()函数来判断给定的字符串中是否包含多字节字符。这两个函数分别返回字符串中的字节数和字符数。如果LENGTH()的值大于CHAR_LENGTH()的大小,那么一定有多字节字符。

set @s= convert('abc' using ucs2);
select length(@s), char_length(@s);

+------------+-----------------+ 
| length(@s) | char_length(@s) | 
+------------+-----------------+ 
|          6 |               3 | 
+------------+-----------------+

从结果中可以看出每个ucs2字符串都包含多字节字符。

虽然unicode字符集utf8中包含多字节字符,但是一个具体的utf8字符串却可能只包含单字节字符,比如:

set @s= convert('abc' using utf8);
select length(@s),char_length(@s);

+------------+-----------------+ 
| length(@s) | char_length(@s) | 
+------------+-----------------+ 
|          3 |               3 | 
+------------+-----------------+

非二进制字符串的另外一个特征是Collation,她决定字符串中字符排序的次序,如果想查看系统中有哪些Collation可用

show collation;

输出结果很长,我截取了一部分:

+--------------------------+----------+-----+---------+----------+---------+ 
| Collation                | Charset  | Id  | Default | Compiled | Sortlen | 
+--------------------------+----------+-----+---------+----------+---------+ 
| big5_chinese_ci          | big5     |   1 | Yes     | Yes      |       1 | 
| big5_bin                 | big5     |  84 |         | Yes      |       1 | 
| dec8_swedish_ci          | dec8     |   3 | Yes     | Yes      |       1 | 
| dec8_bin                 | dec8     |  69 |         | Yes      |       1 |

当没有指定使用何种Collation的是,Default中为Yes的collation就是这个字符集中字符串默认的Cllation。默认的Collation也可以使用:show character set; 进行查看。

Collation可以是大小写敏感的,大小写不敏感的,或者二进制的。名称ci,cs,bin结尾的Collation分别是大小写不敏感,大小写敏感、二进制的。

二进制字符串的比较总是以单个字节为单元的,而二进制Collation对于非二进制字符和窜的比较却是以字符为单元的。

下面的例子说明了Collation如何影响排序结果:

create table t (c char(3) character set latin1);
insert into t values('AAA'),('bbb'),('aaa'),('BBB');
select c from t;

+------+ 
| c    | 
+------+ 
| AAA  | 
| bbb  | 
| aaa  | 
| BBB  | 
+------+

通过对列使用collate操作符,我们可以在选择排序的时候使用哪一个Collation从而影响结果顺序:

1)一个大小写不敏感的Collation将会吧a和A排列在一起。比如:

select c from t order by c collate latin1_swedish_ci;

+------+ 
| c    | 
+------+ 
| AAA  | 
| aaa  | 
| bbb  | 
| BBB  | 
+------+

2)一个大小写敏感的Collation将会吧A和a排列在B和b的签名但是还会将大写排在小写的前面:

select c from t order by c collate latin1_general_cs;

+------+ 
| c    | 
+------+ 
| AAA  | 
| aaa  | 
| BBB  | 
| bbb  | 
+------+

3)一个二进制Collation使用字符的数值为他们排序:

select c from t order by c collate latin1_bin;

+------+ 
| c    | 
+------+ 
| AAA  | 
| BBB  | 
| aaa  | 
| bbb  | 
+------+

相关实践学习
如何在云端创建MySQL数据库
开始实验后,系统会自动创建一台自建MySQL的 源数据库 ECS 实例和一台 目标数据库 RDS。
全面了解阿里云能为你做什么
阿里云在全球各地部署高效节能的绿色数据中心,利用清洁计算为万物互联的新世界提供源源不断的能源动力,目前开服的区域包括中国(华北、华东、华南、香港)、新加坡、美国(美东、美西)、欧洲、中东、澳大利亚、日本。目前阿里云的产品涵盖弹性计算、数据库、存储与CDN、分析与搜索、云通信、网络、管理与监控、应用服务、互联网中间件、移动服务、视频服务等。通过本课程,来了解阿里云能够为你的业务带来哪些帮助     相关的阿里云产品:云服务器ECS 云服务器 ECS(Elastic Compute Service)是一种弹性可伸缩的计算服务,助您降低 IT 成本,提升运维效率,使您更专注于核心业务创新。产品详情: https://www.aliyun.com/product/ecs
目录
相关文章
|
3月前
|
SQL 自然语言处理 关系型数据库
MySQL的match匹配多个字符串的语法
【8月更文挑战第27天】MySQL的match匹配多个字符串的语法
224 67
|
1月前
|
分布式计算 关系型数据库 MySQL
大数据-88 Spark 集群 案例学习 Spark Scala 案例 SuperWordCount 计算结果数据写入MySQL
大数据-88 Spark 集群 案例学习 Spark Scala 案例 SuperWordCount 计算结果数据写入MySQL
50 3
|
1月前
|
关系型数据库 MySQL Java
Django学习二:配置mysql,创建model实例,自动创建数据库表,对mysql数据库表已经创建好的进行直接操作和实验。
这篇文章是关于如何使用Django框架配置MySQL数据库,创建模型实例,并自动或手动创建数据库表,以及对这些表进行操作的详细教程。
68 0
Django学习二:配置mysql,创建model实例,自动创建数据库表,对mysql数据库表已经创建好的进行直接操作和实验。
|
1月前
|
Java 关系型数据库 MySQL
springboot学习五:springboot整合Mybatis 连接 mysql数据库
这篇文章是关于如何使用Spring Boot整合MyBatis来连接MySQL数据库,并进行基本的增删改查操作的教程。
98 0
springboot学习五:springboot整合Mybatis 连接 mysql数据库
|
1月前
|
Java 关系型数据库 MySQL
springboot学习四:springboot链接mysql数据库,使用JdbcTemplate 操作mysql
这篇文章是关于如何使用Spring Boot框架通过JdbcTemplate操作MySQL数据库的教程。
29 0
springboot学习四:springboot链接mysql数据库,使用JdbcTemplate 操作mysql
|
1月前
|
关系型数据库 MySQL 数据库
mysql关系型数据库的学习
mysql关系型数据库的学习
20 0
|
1月前
|
Kubernetes 关系型数据库 MySQL
k8s学习--利用helm部署应用mysql,加深helm的理解
k8s学习--利用helm部署应用mysql,加深helm的理解
200 0
|
2月前
|
SQL 关系型数据库 MySQL
学习MySQL操作的有效方法
学习MySQL操作的有效方法
46 3
|
2月前
|
SQL 关系型数据库 MySQL
如何学习 MySQL?
如何学习 MySQL?
39 3
|
3月前
|
SQL 自然语言处理 关系型数据库
MySQL的match匹配多个字符串的语法
【8月更文挑战第29天】MySQL的match匹配多个字符串的语法
136 2

热门文章

最新文章

下一篇
无影云桌面