mysql字符串属性_MySQL学习-字符串属性-阿里云开发者社区

二进制字符串的比较是通过逐个字节的比较字节数值来进行的。二进制字符串不和字符集相关联。

非二进制字符串是一个Collation列,他存放包含特定字符集和Collation的文本,字符集规定了能够存入字符串的文本,而Collation则规定了对字符进行比较和排序的时候的特性。

所以说非二进制字符串的特征之一就是他们有一个字符集。

如果想查看系统中有哪些字符集的话库银使用下面的命令:

show character set;

输出的结果很长,我截取了一些:

+----------+-----------------------------+---------------------+--------+

| Charset | Description | Default collation | Maxlen |

+----------+-----------------------------+---------------------+--------+

| big5 | Big5 Traditional Chinese | big5_chinese_ci | 2 |

| dec8 | DEC West European | dec8_swedish_ci | 1 |

| cp850 | DOS West European | cp850_general_ci | 1 |

| hp8 | HP West European | hp8_english_ci | 1 |

有些字符集只包含单字节字符,而有些字符集包含多字节字符。有些多字节字符集中的字符有固定数目的字节来表示,但是有些多字节字符集中的字符长度却是可变的。比如unicode使用ucs2字符集来保存,其中的字符都占2个字节,也可以使用utf-8字符集来表示,其中的每个字符都占用一个到3个字节不等。

我们可以使用LRNGTH()和CHAR_LENGTH()函数来判断给定的字符串中是否包含多字节字符。这两个函数分别返回字符串中的字节数和字符数。如果LENGTH()的值大于CHAR_LENGTH()的大小,那么一定有多字节字符。

set @s= convert('abc' using ucs2);

select length(@s), char_length(@s);

+------------+-----------------+

| length(@s) | char_length(@s) |

+------------+-----------------+

|          6 |               3 |

+------------+-----------------+

从结果中可以看出每个ucs2字符串都包含多字节字符。

虽然unicode字符集utf8中包含多字节字符,但是一个具体的utf8字符串却可能只包含单字节字符,比如:

set @s= convert('abc' using utf8);

select length(@s),char_length(@s);

+------------+-----------------+

| length(@s) | char_length(@s) |

+------------+-----------------+

|          3 |               3 |

+------------+-----------------+

非二进制字符串的另外一个特征是Collation,她决定字符串中字符排序的次序,如果想查看系统中有哪些Collation可用:

show collation;

输出结果很长,我截取了一部分:

+--------------------------+----------+-----+---------+----------+---------+

| Collation                | Charset  | Id  | Default | Compiled | Sortlen |

+--------------------------+----------+-----+---------+----------+---------+

| big5_chinese_ci          | big5     |   1 | Yes     | Yes      |       1 |

| big5_bin                 | big5     |  84 |         | Yes      |       1 |

| dec8_swedish_ci          | dec8     |   3 | Yes     | Yes      |       1 |

| dec8_bin                 | dec8     |  69 |         | Yes      |       1 |

当没有指定使用何种Collation的是,Default中为Yes的collation就是这个字符集中字符串默认的Cllation。默认的Collation也可以使用:show character set; 进行查看。

Collation可以是大小写敏感的,大小写不敏感的,或者二进制的。名称ci,cs,bin结尾的Collation分别是大小写不敏感,大小写敏感、二进制的。

二进制字符串的比较总是以单个字节为单元的,而二进制Collation对于非二进制字符和窜的比较却是以字符为单元的。

下面的例子说明了Collation如何影响排序结果:

create table t (c char(3) character set latin1);

insert into t values('AAA'),('bbb'),('aaa'),('BBB');

select c from t;

+------+

| c    |

+------+

| AAA  |

| bbb  |

| aaa  |

| BBB  |

+------+

通过对列使用collate操作符,我们可以在选择排序的时候使用哪一个Collation从而影响结果顺序:

1)一个大小写不敏感的Collation将会吧a和A排列在一起。比如:

select c from t order by c collate latin1_swedish_ci;

+------+

| c    |

+------+

| AAA  |

| aaa  |

| bbb  |

| BBB  |

+------+

2)一个大小写敏感的Collation将会吧A和a排列在B和b的签名但是还会将大写排在小写的前面:

select c from t order by c collate latin1_general_cs;

+------+

| c    |

+------+

| AAA  |

| aaa  |

| BBB  |

| bbb  |

+------+

3)一个二进制Collation使用字符的数值为他们排序:

select c from t order by c collate latin1_bin;

+------+

| c    |

+------+

| AAA  |

| BBB  |

| aaa  |

| bbb  |

+------+

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
经导师精心指导并认可、获 98 分的毕业设计项目!【项目资源】:微信小程序。【项目说明】:聚焦计算机相关专业毕设及实战操练,可作课程设计与期末大作业,含全部源码,能直用于毕设,经严格调试,运行有保障!【项目服务】:有任何使用上的问题,欢迎随时与博主沟通,博主会及时解答。 经导师精心指导并认可、获 98 分的毕业设计项目!【项目资源】:微信小程序。【项目说明】:聚焦计算机相关专业毕设及实战操练,可作课程设计与期末大作业,含全部源码,能直用于毕设,经严格调试,运行有保障!【项目服务】:有任何使用上的问题,欢迎随时与博主沟通,博主会及时解答。 经导师精心指导并认可、获 98 分的毕业设计项目!【项目资源】:微信小程序。【项目说明】:聚焦计算机相关专业毕设及实战操练,可作课程设计与期末大作业,含全部源码,能直用于毕设,经严格调试,运行有保障!【项目服务】:有任何使用上的问题,欢迎随时与博主沟通,博主会及时解答。 经导师精心指导并认可、获 98 分的毕业设计项目!【项目资源】:微信小程序。【项目说明】:聚焦计算机相关专业毕设及实战操练,可作课程设计与期末大作业,含全部源码,能直用于毕设,经严格调试,运行有保障!【项目服务】:有任何使用上的问题,欢迎随时与博主沟通,博主会及时解答。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值