java中文问题-CSDN博客

本文链接：https://blog.csdn.net/dazern/article/details/382978

写在前面的话：

Java中文问题一直是困饶着初学java的主要问题，而且即使接触java有一段时间的“老手”也经常会在java的中文问题上栽跟头。下面就我个人理解，对Java中文问题进行一些阐释。

理解Java内部关于编码的原理：

Java内部是Unicode编码，所谓Unicode编码即是：全世界所有符号进行了统一编码的结果。但是有一点值得提出一下，用它来处理汉字是合适的，但是英文却吃亏了，要用多一倍的空间来存储。所以程序员们写的程序不支持UNICODE情况很常见。

其他相关编码方式还有（说一些和中文相关的大家也许经常见到的编码方式）：GB2312和GBK。其中GB2312是对GBK的升级，GBK是GB2312的一个子集，例如GB2312可以支持繁体字。BIG5是台湾编码方式。ISO8859-1编码：ISO8859_1，这个是英文系统缺省的8bit编码，因为是8bit的，所以不会把汉字的高位删去，所以用它也是可以处理汉字的。

理解Java的IO机制：

Java的IO基类分为：InputStream、OutputStream和Reader、Writer

在I/O时如果使用Reader/Writer就要发生编码转换，使用系统属性file.encoding作为编码方式。如果使用Stream就没有转换的事情了，那是Binary的数据。

1、在Reader/Writer上加encoding的选项时候，在Reader中的encoding表示把数据从encoding转换成Unicode，writer就是把Unicode的字符转换成encoding格式的。

2、用String.getByte()把字符串转换成指定编码。

JSP/Servlet问题：

JSP/Servlet的中文问题有两种解决办法：

1、不在程序中进行编码转换，把这个工作交给浏览器，方法就是用javac –encoding GBK *.java来编译所有的bean，然后在JSP页面上加
<%@ page contentType="text/html;charset=gb2312" %>或者是在HTML中直接加： <meta http-equiv="Content-Type" content="text/html; charset=gb2312">
到底加那个，试试就知道了。

2、在程序中指定编码，用javac –encoding ISO8859_1 *.java来编译所有的bean，在涉及到中文显示的程序上加
str=new String(str.getBytes("ISO8859_1"));

上面两种方法不能混用，意思就是要么就是GBK，要么就是ISO8859_1，从里到外都一样就好了。

另外一个好办法就是采用filter：

import javax.servlet.*;

import java.io.*;

public class RequestEncodeFilter implements Filter {

String charset = null;

public void init(FilterConfig config) throws ServletException {

charset = config.getInitParameter("charset");

if (charset == null)

charset = "GBK";

}

public void doFilter(ServletRequest request, ServletResponse response,

FilterChain chain) throws IOException,

ServletException {

request.setCharacterEncoding(charset);

chain.doFilter(request, response);

}

public void destroy() {

}

在你的web.xml配置好fillter就可以了。这个方法是最便捷的，基本可以实现让java程序员原理中文问题。

数据库JDBC的中文问题：

一般只要按照数据库指定的编码进行转换，比如按照ISO8859_1读，ISO8859_1写，一般就没什么问题了。我也碰到过一些例外情况，如：对于存储的代码不进行转码机制，在数据库中存储的是乱码。但是，读取的时候却是正常的中文。我想这正好是Unicodeà特定coding—>Unicode编码，所以凑巧碰上了吧，我想数据库内部处理过程在起作用吧，当然我们谁也不喜欢一打开数据库看到的是一堆乱码。那就还是按照自己指定的方式来进行转码解码吧。

另外一种办法是：在JDBC连接数据库过程就进行字符编码转换：

如：ConnectionString="jdbc:mysql://localhost/dbname?user=root&password=dphw&useUnicode=true&characterEncoding=8859_1(mysql的例子)

java和javaw:

他们的区别就不多说了，主要是java会在黑窗口下进行，而javaw不会，所以例如jb这样的开发工具都是默认采用javaw来进行run这些java的class的。

但是有一点需要提出的是：

javaw会使用与java不同的Local配置进行工作，导致了一些中文问题，而java就是好好的。JBuilder也是好好的，没有问题，调用javaw也不是它的错，难道你想每次运行或者调试的时候蹦出个DOS黑框么？

可以采用如下办法解决jb中的javaw造成的中文问题。

在JBuilder中选择Project->Project Properties->run->edit->VM Parameters，填上-Dfile.encoding=GBK -Ddefault.client.encoding=GBK -Duser.language=zh -Duser.region=CN 就行了！

原理也就是在javaw加上如上的配置参数。

其他配置方面：

在JDK低版本和UNIX下，需要改动font.properties，让JAVA VM能够找到合适的字体来显示汉字。