Latin1、ISO-8859-1和中文表示

ISO Latin-1字符集

Latin1、ISO-8859-1和中文表示

latin-1 

=======================

ISO Latin-1字符集

ISO Latin-1字符集是Unicode字符集的一个子集,对应于IE4+中Unicode字符指令表的前256个条目。下面表格中详细提供了每个字符及字符的十进制编码和HTML已命名实体。其中Unicode字符为双字节16位,可以表示任何一种语言符号;而Latin-1字符集是单字节8位,只能够表示英文和西欧字符。本表按十进制字符编号顺序排列,可以快速查找对象字符和名称。
————————————————
版权声明:本文为CSDN博主「tenfyguo」的原创文章,遵循CC 4.0 BY-SA版权协议,转载请附上原文出处链接及本声明。
原文链接:https://blog.csdn.net/tenfyguo/article/details/5918142

latin-1

Latin1是ISO-8859-1的别名,有些环境下写作Latin-1。ISO-8859-1编码是单字节编码,向下兼容ASCII,其编码范围是0x00-0xFF,0x00-0x7F之间完全和ASCII一致,0x80-0x9F之间是控制字符,0xA0-0xFF之间是文字符号。

-------------------------------------------

Qt5官方手册

别名

 

GBK Text Codec

The GBK codec provides conversion to and from the Chinese GB18030/GBK/GB2312 encoding.

GBK, formally the Chinese Internal Code Specification, is a commonly used extension of GB 2312-80. Microsoft Windows uses it under the name codepage 936.

-------------------------------------------

ISO-8859-1

ISO-8859-1收录的字符除ASCII收录的字符外,还包括西欧语言、希腊语、泰语、阿拉伯语、希伯来语对应的文字符号。欧元符号出现的比较晚,没有被收录在ISO-8859-1当中。

因为ISO-8859-1编码范围使用了单字节内的所有空间,在支持ISO-8859-1的系统中传输和存储其他任何编码的字节流都不会被抛弃。换言之,把其他任何编码的字节流当作ISO-8859-1编码看待都没有问题。这是个很重要的特性,MySQL数据库默认编码是Latin1就是利用了这个特性。ASCII编码是一个7位的容器,ISO-8859-1编码是一个8位的容器。

https://www.cnblogs.com/judes/p/6893326.html

Latin1、ISO-8859-1和中文表示

https://blog.csdn.net/dyzhen/article/details/123268860

从本质上说,ISO-8859-1是单字节编码,自身不能显示中文,若要显示中文,必须和其他能显示中文的编码配合,如“GBK”,“UTF-8",

以ISO-8859-1编码的文本,都以bytes[]的形式保存,若要显示中文,只需以显示平台的默认编码格式进行解码即可。若仍然以ISO-8859-1格式解码,得到的中文字符肯定是乱码,因为ISO-8859-1自身不能显示中文。

Latin1即ISO-8859-1,它是单字节编码,它本身无法表示中文,不过既然它是byte[], 那么,其它编码内容,就可以以它存起来(toLatin1),用时候用该编码解释即可。

?注:其他编码的字节长度为2个,或多个字节;因此,可以存放 2个或多个的 窄字节字符(ASCII /或 latin1),并用“窄字节字符”的各种组合,来解释成(映射成)其他字符集??

QString.toLatin1() // 返回QByteArray,可以认为,toLatin1并不是要转换为latin语,而仅仅是利用它单字节存储特性作为字节数组用。        
————————————————
版权声明:本文为CSDN博主「opera321」的原创文章,遵循CC 4.0 BY-SA版权协议,转载请附上原文出处链接及本声明。
原文链接:https://blog.csdn.net/dyzhen/article/details/123268860

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
ISO 8859-1,又称Latin-1或“西欧语言”,是国际标准化组织内ISO/IEC 8859的第一个8位字符集。它以ASCII为基础,在空置的0xA0-0xFF的范围内,加入96个字母及符号,藉以供使用附加符号的拉丁字母语言使用。\[1\]ISO-8859-1码是在ASCII码的基础上发展而来的,所以有时也叫扩展ASCII码。与ASCII码相同,它的编码也是占一个字节(8个bit),但与ASCII码不同的时它8个bit位全用到了。ISO-8859-1编码兼容ASCII码,0000 0000~0111 1111仍然是ASCII码的内容。\[2\]在Java中,可以使用String类的getBytes方法将字符串转换为ISO-8859-1编码的字节数组,也可以使用String类的构造函数将ISO-8859-1编码的字节数组转换为字符串。\[3\] #### 引用[.reference_title] - *1* *3* [ISO-8859-1疑问](https://blog.csdn.net/lgh1992314/article/details/78684117)[target="_blank" data-report-click={"spm":"1018.2226.3001.9630","extra":{"utm_source":"vip_chatgpt_common_search_pc_result","utm_medium":"distribute.pc_search_result.none-task-cask-2~all~insert_cask~default-1-null.142^v91^control,239^v3^insert_chatgpt"}} ] [.reference_item] - *2* [搞清楚字符编码03-ISO-8859-1码](https://blog.csdn.net/Sacredness/article/details/89439746)[target="_blank" data-report-click={"spm":"1018.2226.3001.9630","extra":{"utm_source":"vip_chatgpt_common_search_pc_result","utm_medium":"distribute.pc_search_result.none-task-cask-2~all~insert_cask~default-1-null.142^v91^control,239^v3^insert_chatgpt"}} ] [.reference_item] [ .reference_list ]

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值