史上最简单的 MySQL 教程(十一)「列类型 之 字符串型」

本文涉及的产品
RDS MySQL DuckDB 分析主实例,基础系列 4核8GB
RDS AI 助手,专业版
RDS MySQL DuckDB 分析主实例,集群系列 4核8GB
简介: 史上最简单的 MySQL 教程(十一)「列类型 之 字符串型」

史上最简单的 MySQL 教程(十一)「列类型 之 字符串型」

列类型(数据类型)

所谓的列类型,其实就是指数据类型,即对数据进行统一的分类,从系统的角度出发是为了能够使用统一的方式进行管理,更好的利用有限的空间。


在 SQL 中,将数据类型分成了三大类,分别为:数值型、字符串型和日期时间型。


8242780220e7a3a7d021b4ad64ed1286.png


字符串型


在 SQL 中,将字符串类型分成了 6 类,分别为:char、varchar、text、blob、enum和set.


第 1 类:定长字符串


定长字符串:char,即磁盘(二维表)在定义结构的时候就已经确定了最终数据的存储长度。


char(L):L 表示 Length,即可以存储的长度,单位为字符,最大长度为 255;

char(4):表示在 UTF8 环境下,需要 4*3=12 个字节。

第 2 类:变长字符串


变长字符串:varchar,即在分配存储空间的时候,按照最大的空间分配,但是实际用了多少,则是根据具体的数据来确定。


varchar(L):L 表示 Length,理论长度是 65536,但是会多出 1 到 2 个字节来确定存储的实际长度;

varchar(10):例如存储 10 个汉字,在 UTF8 环境下,需要 10*3+1=31 个字节。

实际上,如果存储长度超过 255 个字符,则既不用定长字符串也不用变长字符串,而是用文本字符串text.


如何选择定长字符串或者是变长字符串呢?


定长字符串对磁盘空间比较浪费,但是效率高:如果数据基本上确定长度都一样,就使用定长字符串,例如身份证、电话号码等;

变长字符串对磁盘空间比较节省,但是效率低:如果数据不能确定长度(不同的数据有变化),就使用变长字符串,例如地址、姓名等。

第 3 类:文本字符串


如果数据量非常大,通常说超过 255 个字符就会使用文本字符串。


文本字符串根据存储的格式进行分类,可以分为:


text:存储文字;

blob:存储二进制数据(其实际上都是存储路径),通常不用。

第 4 类:枚举字符串


枚举字符串:enum,需要事先将所有可能出现的结果都设计好,实际上存储的数据必须是规定好的数据中的一个。


枚举字符串的使用方式:


定义:enum('元素1','元素2','元素3'...),例如enum('男','女','保密');

使用:存储的数据,只能是事先定义好的数据。

执行如下 SQL 语句创建枚举表,进行测试:

-- 创建枚举表
create table my_enum(
  gender enum('男','女','保密')
)charset utf8;

eb53f344d45847acf20bf2c7dbf347e9.png

再执行如下 SQL 语句,向表my_enum中插入测试数据:

-- 插入测试数据
insert into my_enum values ('男'),('女'),('保密');
insert into my_enum values ('male');

c030bf3c4231deee2af7fde30c9cdbf9.png


通过上面的测试,咱们可以发现使用枚举字符串有一个好处,那就是:规范数据格式,插入表中的数据只能是事先定义好的某个数据。


此外,枚举字符串还有一个作用,那就是:节省存储空间(枚举数据通常都有一个别名),枚举实际上存储的是数值而不是字符串本身。


在 MySQL 中,系统是有自动转换数据格式的功能的。在这里,咱们可以证明枚举字段存储的是数值,具体方法为:将数据取出来+0,如果是字符串最终结果永远为0,否则就是其他值。


-- 验证枚举字段实际存储的格式
select gender + 0,gender from my_enum;

fec68f24c386f74fe99c170870b3cf74.png

观察上述结果,咱们可以找出枚举元素的实际规律,即按照元素出现的顺序,从1开始编号。接下来,咱们再来了解枚举的原理:


枚举在进行数据规范(定义)的时候,系统会自动建立一个数字与枚举元素的对应关系(放在日志中);在进行数据插入的时候,系统自动将字符串转换为对应的数值进行存储;在进行数据提取的时候,系统自动将数值转换成对应的字符串进行显示。

通过阅读以上枚举的原理,咱们可以知道:使用枚举的效率并不高(低于其他类型的数据),但能规范数据和节省存储空间。


第 5 类:集合字符串


集合字符串:set,跟枚举类似,实际存储的是数值而不是字符串。


集合字符串的使用方式:


定义:set,元素列表;

使用:可以使用元素列表中的多个元素,用逗号分隔。

执行如下 SQL 语句创建枚举表,进行测试:

-- 创建集合表
create table my_set(
  hobby set('音乐','电影','旅行','美食','摄影','运动','宠物')
)charset utf8;

143c2555e3833bce2edd0dcffe5f5342.png

再执行如下 SQL 语句,向表my_set中插入测试数据:

-- 插入测试数据
insert into my_set values ('电影,美食,宠物');
insert into my_set values (3);

76e33c368aee5ec14c6c113734fd4505.png

再执行如下 SQL 语句,查看表my_set中的数据:

-- 查看数据
select hobby + 0,hobby from my_set;

67dd93ba0758b66705b1214d1881d346.png


观察上面的结果,相信大部分童鞋也懵啦!对于3还好理解,3=2+1,对应于集合中数据的编号,也正是音乐和电影;但是74是什么鬼啊?在此,咱们不妨将集合('音乐','电影','旅行','美食','摄影','运动','宠物')中的元素选中的记为1,没有选中的记为0,表示成二进制,也就是:


0101001

再将上面的二进制反过来:


1001010

不妨算算,上述二进制对应的十进制数,即为74.


到这里,相信大家已经恍然大悟啦,原来:集合字符串中每一个元素都对应一个二进制位,其中被选中的为1,未选中的为0,最后在反过来,这个二进制数对应的十进制数即为其数据库中实际存储的是数值。


此外,集合字符串中插入元素的顺序并没有影响,最终系统都会自动去匹配集合的顺序,即:


-- 插入测试数据
insert into my_set values ('电影,美食,旅行');
insert into my_set values ('旅行,电影,美食');

上述两个 SQL 语句会产生相同的结果:

如上图所示,显然咱们的结论得到了验证。

最后,集合的原理同枚举类似,因此可以的到相同的结论,即:使用集合的效率并不高(低于其他类型的数据),但能规范数据和节省存储空间。


相关实践学习
如何快速连接云数据库RDS MySQL
本场景介绍如何通过阿里云数据管理服务DMS快速连接云数据库RDS MySQL,然后进行数据表的CRUD操作。
MySQL数据库入门学习
本课程通过最流行的开源数据库MySQL带你了解数据库的世界。   相关的阿里云产品:云数据库RDS MySQL 版 阿里云关系型数据库RDS(Relational Database Service)是一种稳定可靠、可弹性伸缩的在线数据库服务,提供容灾、备份、恢复、迁移等方面的全套解决方案,彻底解决数据库运维的烦恼。 了解产品详情: https://www.aliyun.com/product/rds/mysql 
目录
相关文章
|
6月前
|
安全 关系型数据库 MySQL
CentOS 7 yum 安装 MySQL教程
在CentOS 7上安装MySQL 8,其实流程很清晰。首先通过官方Yum仓库来安装服务,然后启动并设为开机自启。最重要的环节是首次安全设置:需要先从日志里找到临时密码来登录,再修改成你自己的密码,并为远程连接创建用户和授权。最后,也别忘了在服务器防火墙上放行3306端口,这样远程才能连上。
1306 16
|
10月前
|
存储 关系型数据库 MySQL
【免费动手教程上线】阿里云RDS MySQL推出大容量高性能存储:高性能本地盘(最高16TB存储空间)、高性能云盘(最高64TB存储空间)
阿里云RDS MySQL提供高性能本地盘与高性能云盘等存储方案,满足用户大容量、低延迟需求。高性能本地盘单盘最大16TB,IO延时微秒级;高性能云盘兼容ESSD特性,支持IO性能突发、BPE及16K原子写等能力。此外,阿里云还提供免费动手体验教程,帮助用户直观感受云数据库 RDS 存储性能表现。
|
9月前
|
关系型数据库 MySQL
MySQL字符串拼接方法全解析
本文介绍了四种常用的字符串处理函数及其用法。方法一:CONCAT,用于基础拼接,参数含NULL时返回NULL;方法二:CONCAT_WS,带分隔符拼接,自动忽略NULL值;方法三:GROUP_CONCAT,适用于分组拼接,支持去重、排序和自定义分隔符;方法四:算术运算符拼接,仅适用于数值类型,字符串会尝试转为数值处理。通过示例展示了各函数的特点与应用场景。
|
12月前
|
存储 SQL 关系型数据库
【YashanDB知识库】MySQL迁移至崖山char类型数据自动补空格问题
**简介**:在MySQL迁移到崖山环境时,若字段类型为char(2),而应用存储的数据仅为'0'或'1',查询时崖山会自动补空格。原因是mysql的sql_mode可能启用了PAD_CHAR_TO_FULL_LENGTH模式,导致保留CHAR类型尾随空格。解决方法是与应用确认数据需求,可将崖山环境中的char类型改为varchar类型以规避补空格问题,适用于所有版本。
|
12月前
|
关系型数据库 MySQL Java
【YashanDB知识库】崖山BIT类型对MYSQL兼容问题
【YashanDB知识库】崖山BIT类型对MYSQL兼容问题
|
12月前
|
自然语言处理 关系型数据库 MySQL
MySQL索引有哪些类型?
● 普通索引:最基本的索引,没有任何限制。 ● 唯一索引:索引列的值必须唯一,但可以有空值。可以创建组合索引,则列值的组合必须唯一。 ● 主键索引:是特殊的唯一索引,不可以有空值,且表中只存在一个该值。 ● 组合索引:多列值组成一个索引,用于组合搜索,效率高于索引合并。 ● 全文索引:对文本的内容进行分词,进行搜索。
|
机器学习/深度学习 关系型数据库 MySQL
mysql bit对gorm使用何种类型?
在GORM中使用MySQL的BIT类型时,通常使用 `bool`类型来处理BIT(1),使用 `[]byte`类型来处理BIT(N)(N > 1)。通过正确的类型映射和位操作,可以高效地处理位字段数据。确保在定义结构体字段时,明确指定字段类型,以便GORM能够正确地处理数据库交互。
343 18
|
存储 SQL 关系型数据库
【YashanDB 知识库】MySQL 迁移至崖山 char 类型数据自动补空格问题
问题分类】功能使用 【关键字】char,char(1) 【问题描述】MySQL 迁移至崖山环境,字段类型源端和目标端都为 char(2),但应用存储的数据为'0'、'1',此时崖山查询该表字段时会自动补充空格 【问题原因分析】mysql 有 sql_mode 控制,检查是否启用了 PAD_CHAR_TO_FULL_LENGTH SQL 模式。如果启用了这个模式,MySQL 才会保留 CHAR 类型字段的尾随空格,默认没有启动。 #查看sql_mode mysql> SHOW VARIABLES LIKE 'sql_mode'; 【解决/规避方法】与应用确认存储的数据,正确定义数据
|
存储 关系型数据库 MySQL
mysql怎么查询longblob类型数据的大小
通过本文的介绍,希望您能深入理解如何查询MySQL中 `LONG BLOB`类型数据的大小,并结合优化技术提升查询性能,以满足实际业务需求。
562 6

推荐镜像

更多