java中含中文字符串的编码和解码问题。

最新推荐文章于 2022-07-13 21:38:43 发布

dearbaba_8520

最新推荐文章于 2022-07-13 21:38:43 发布

阅读量1.2k

点赞数

文章标签： java 中文字符编码字符串 servlet 问题开发解码

原文地址为： java中含中文字符串的编码和解码问题。

1、在java开发中经常被文字乱码的问题困扰。下面全面解释下字符串的编码和解码。

如 String str = "中国"

编码：byte[] bts = str.getBytes("编码方式");//常用编码方式 gbk、utf-8、gb2312、iso-8859-1等等。

解码：String b = new String(bts,"解码方式");//解码方式对应常用编码方式。

2、常识：正常（正常显示的字符串无乱码）解码后的字符串对象可以用任意方式编码。但解码要正常显示，必须用对应的编码方式解码。（对于中文要保证正常显示必须采用中文编码/解码方式）

如 String str = "中国";//这个就是正常显示的字符串

以下任意方式（中文）编码/解码-----------

String b1 = new String(str.getBytes("gbk"),"gbk");

String b2 = new String(str.getBytes("utf-8"),"utf-8");

String b3 = new String(str.getBytes("gb2312"),"gb2312");

以上三种方式的字符串对象都是采用中文方式编码/解码，所以都会是正常并无乱码。

3、当没采用对应方式解码时（也就是所谓的乱码）怎么转成正常显示而无乱码。

如 String str = "中国";

String b1 = new String(str.getBytes("gbk"),"gbk");//这里的b1就是采用的gbk的方式解码的：：：：b1不会乱码的

String b2 = new String(b1.getBytes(),"utf-8");//这里对b1编码后的字节数组重新用utf-8而没有用对应的gbk方式解码。：：：：：b2将会是乱码的

以下开始将乱码转成正常显示

String b3 = new String(b2.getBytes("utf-8"),"gbk")//这里编码方式（utf-8）必须用上述b2的解码方式,而解码方式（gbk）必须用b1的解码方式。因为是b2把正常显示的b1解码成乱码。：：：：：：：b3不会是乱码的。

在实际应用中出现的乱码，都是这个原因造成的，乱码不是不可逆的，上述步骤就是一个逆转的过程。

4常见应用举例。

在web开发中，tomcat对于传输的字符串都是采用iso-8859-1编码/解码方式。而客户端（浏览器端对于中文都是用gbk或utf-8中文编码/解码方式），所以传到后台都会是乱码的。容器一般都是有处理的，所以中文能正常显示和存储。但有些情况也是会出现乱码的，解决方式如下

String b = new String(str.getBytes("iso-8859-1","客户端的编码/解码方式")//中文解码方式一般用的是utf-8或者gbk。

如：

String b1 = new String(str.getBytes("iso-8859-1","utf-8");

转载请注明本文地址： java中含中文字符串的编码和解码问题。

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。