Base64 编码原理及代码实现

最新推荐文章于 2024-05-31 09:05:13 发布

AIGC_Allen

最新推荐文章于 2024-05-31 09:05:13 发布

阅读量1k

点赞数

文章标签：网络安全服务器

本文链接：https://blog.csdn.net/text2206/article/details/128505007

版权

为什么是 base64 而不是 base128、base256 呢？其实原因很简单，因为在 ASCII 码表中的可打印字符只有 95 个，所以选取 64 个可打印字符是最为合理的。既然如此，那是不是也有 base32、base16 呢？对，当然可以有。只是目前大多用到的还是 base64 编码。

摘要由CSDN通过智能技术生成

Base64 编码原理及代码实现

所谓 base64 编码就是从 ASCII 码表中选取64个可打印字符（A-Za-z0-9+/）作为基本字符集对其它字符进行编码转换。加上作为填充的 “=” 实际上是 65 个字符。

Base64 产生的原因

要想了解 base64 就得先了解下 ASCII 码表， ASCII 码表是由以英语为母语的美国制定。英语用128个符号编码就够了，但是用来表示其他语言，128个符号是不够的。比如，在法语中，字母上方有注音符号，它就无法用 ASCII 码表示。于是，一些欧洲国家就决定，利用字节中闲置的最高位编入新的符号。比如，法语中的é的编码为130（二进制10000010）。这样一来，这些欧洲国家使用的编码体系，可以表示最多256个符号。

但是，这里又出现了新的问题。不同的国家有不同的字母，因此，哪怕它们都使用256个符号的编码方式，代表的字母却不一样。比如，130在法语编码中代表了é，在希伯来语编码中却代表了字母Gimel (ג)，在俄语编码中又会代表另一个符号。但是不管怎样，所有这些编码方式中，0–127表示的符号是一样的，不一样的只是128–255的这一段。

至于亚洲国家的文字，使用的符号就更多了，汉字就多达10万左右。一个字节只能表示256种符号，肯定是不够的，就必须使用多个字节表达一个符号。比如，简体中文常见的编码方式是 GB2312，使用两个字节表示一个汉字，所以理论上最多可以表示 256 * 256 = 65536 个符号。

而在网络上交换数据时，比如说从A地传到B地，往往要经过多个路由设备，由于不同的设备对字符的处理方式有一些不同，这样那些不可见字符就有可能被处理错误，这是不利于传输的。所以就先把数据先做一个 Base64 编码，统统变成可见字符，这样出错的可能性就大降低了。

为什么是 Base64？

Base64 编码的理论实现

前

最低0.47元/天解锁文章

AIGC_Allen

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
Base64 编码原理及代码实现

为什么是 base64 而不是 base128、base256 呢？其实原因很简单，因为在 ASCII 码表中的可打印字符只有 95 个，所以选取 64 个可打印字符是最为合理的。既然如此，那是不是也有 base32、base16 呢？对，当然可以有。只是目前大多用到的还是 base64 编码。
复制链接

扫一扫