java中文问题(原创)

原创 2005年05月04日 21:14:00

写在前面的话:

Java中文问题一直是困饶着初学java的主要问题,而且即使接触java有一段时间的老手也经常会在java的中文问题上栽跟头。下面就我个人理解,对Java中文问题进行一些阐释。

理解Java内部关于编码的原理:

Java内部是Unicode编码,所谓Unicode编码即是:全世界所有符号进行了统一编码的结果。但是有一点值得提出一下,用它来处理汉字是合适的,但是英文却吃亏了,要用多一倍的空间来存储。所以程序员们写的程序不支持UNICODE情况很常见。

其他相关编码方式还有(说一些和中文相关的大家也许经常见到的编码方式):GB2312GBK。其中GB2312是对GBK的升级,GBKGB2312的一个子集,例如GB2312可以支持繁体字。BIG5是台湾编码方式。ISO8859-1编码:ISO8859_1,这个是英文系统缺省的8bit编码,因为是8bit的,所以不会把汉字的高位删去,所以用它也是可以处理汉字的。

 

理解JavaIO机制:

JavaIO基类分为:InputStreamOutputStreamReaderWriter

I/O时如果使用Reader/Writer就要发生编码转换,使用系统属性file.encoding作为编码方式。如果使用Stream就没有转换的事情了,那是Binary的数据。

1、在Reader/Writer上加encoding的选项时候,在Reader中的encoding表示把数据从encoding转换成Unicodewriter就是把Unicode的字符转换成encoding格式的。

 

2、用String.getByte()把字符串转换成指定编码。

 

JSP/Servlet问题:

JSP/Servlet的中文问题有两种解决办法:

1、                    不在程序中进行编码转换,把这个工作交给浏览器,方法就是用javac encoding GBK *.java来编译所有的bean,然后在JSP页面上加
 <%@ page contentType="text/html;charset=gb2312" %>
或者是在HTML中直接加: <meta http-equiv="Content-Type" content="text/html; charset=gb2312">
 
到底加那个,试试就知道了。

2、                    在程序中指定编码,用javac encoding ISO8859_1 *.java来编译所有的bean,在涉及到中文显示的程序上加
 str=new String(str.getBytes("ISO8859_1"));

上面两种方法不能混用,意思就是要么就是GBK,要么就是ISO8859_1,从里到外都一样就好了。

另外一个好办法就是采用filter

import javax.servlet.*;

import java.io.*;

 

public class RequestEncodeFilter implements Filter {

 

    String charset = null;

 

    public void init(FilterConfig config) throws ServletException {

        charset = config.getInitParameter("charset");

        if (charset == null)

            charset = "GBK";

    }

 

    public void doFilter(ServletRequest request, ServletResponse response,

                         FilterChain chain) throws IOException,

        ServletException {

        request.setCharacterEncoding(charset);

        chain.doFilter(request, response);

    }

 

    public void destroy() {

 

    }

}

 

在你的web.xml配置好fillter就可以了。这个方法是最便捷的,基本可以实现让java程序员原理中文问题。

 

  数据库JDBC的中文问题

一般只要按照数据库指定的编码进行转换,比如按照ISO8859_1读,ISO8859_1写,一般就没什么问题了。我也碰到过一些例外情况,如:对于存储的代码不进行转码机制,在数据库中存储的是乱码。但是,读取的时候却是正常的中文。我想这正好是Unicodeà特定coding—>Unicode编码,所以凑巧碰上了吧,我想数据库内部处理过程在起作用吧,当然我们谁也不喜欢一打开数据库看到的是一堆乱码。那就还是按照自己指定的方式来进行转码解码吧。

 

另外一种办法是:在JDBC连接数据库过程就进行字符编码转换:

如:ConnectionString="jdbc:mysql://localhost/dbname?user=root&password=dphw&useUnicode=true&characterEncoding=8859_1(mysql的例子)

 

javajavaw:

他们的区别就不多说了,主要是java会在黑窗口下进行,而javaw不会,所以例如jb这样的开发工具都是默认采用javaw来进行run这些javaclass的。

但是有一点需要提出的是:

javaw会使用与java不同的Local配置进行工作,导致了一些中文问题,而java就是好好的。JBuilder也是好好的,没有问题,调用javaw也不是它的错,难道你想每次运行或者调试的时候蹦出个DOS黑框么?

可以采用如下办法解决jb中的javaw造成的中文问题。

 JBuilder中选择Project->Project Properties->run->edit->VM Parameters,填上-Dfile.encoding=GBK -Ddefault.client.encoding=GBK -Duser.language=zh -Duser.region=CN 就行了!

原理也就是在javaw加上如上的配置参数。

 

其他配置方面:

JDK低版本和UNIX下,需要改动font.properties,让JAVA VM能够找到合适的字体来显示汉字。

 

总结:

上面就我所接触的几个方面谈谈java的中文问题。其中包括理解Java内部关于编码的原理、理解JavaIO机制、JSP/Servlet问题、 数据库JDBC的中文问题、javajavaw、其他配置方面。

肯定会有许多疏漏的地方,希望各位给予补充。

0554

 

本博客声明,特此声明!!!

1、本博客的原创文章,都是本人平时学习所做的笔记,禁止转载,谢谢合作。2、本博客的文章,未注明原创的,转载自其它博客或网站,作为自己的参考资料,感谢这些文章的原创人员。3、如有侵犯您的知识产权和版权问...
  • xinxin19881112
  • xinxin19881112
  • 2009年09月02日 17:06
  • 998

【伪原创工具】最好的伪原创工具

【伪原创工具】最好的伪原创工具,原创,这个对个人站长来说,几乎不可能,因为没有那么多时间和精力去搞,一般是大站招聘编辑来做这个工作。 靠采集更新网站,早年在火车头采集出现之前还有用,因为在火车头出来...
  • i_like_cpp
  • i_like_cpp
  • 2011年10月10日 18:54
  • 5661

JDK中文版参考文档

Sun 公司提供的Java API Docs是学习和使用Java语言中最经常使用的参考资料之一。但是长期以来此文档只有英文版,对于中国地区的Java开发者来说相当的不便。目前Sun 公司正在组织多方力...
  • DL88250
  • DL88250
  • 2007年01月22日 03:02
  • 2821

java中含中文字符串的编码和解码问题

java中含中文字符串的编码和解码问题。 1、在java开发中经常被文字乱码的问题困扰。下面全面解释下字符串的编码和解码。 如 String str = "中国" 编码:...
  • TuxedoLinux
  • TuxedoLinux
  • 2017年11月19日 21:55
  • 45

手把手教你玩转QQ的原创表情

QQ的原创表情非常的可爱,做得比较精致,深受广大QQ用户的喜爱;但怎么将这些表情保存下来,好让我可以在别的地方用呢? 乖乖牛在线将从不同的视角,为你解析QQ原创表情的存储、互通、保护的机制;熟悉了这些...
  • TragicGuy
  • TragicGuy
  • 2015年10月23日 13:58
  • 1296

伪原创文章的方法

1.修改标题 标题是搜索引擎读取相关数据的第一步,因此,伪原创内容页的全新标题,搜索引擎而言对这个页面的评价也就高些。具体 的操作技巧有,添加或删减词语词组、换汤不换药(全新的描述方式,意义雷同)、同...
  • zongcaihui
  • zongcaihui
  • 2015年10月12日 15:18
  • 271

linux下java的中文原创

今天在LINUX下做DBCP数据源的时候发现了一个问题数据连接用GB2312的时候JSP页面也用GB2312却显示乱码!!把我给气乱了!!后试着用UTF-8做为数据库编码时一切OKDBCP配置的URL...
  • hmpop
  • hmpop
  • 2005年03月05日 04:14
  • 481

DICK原创:Rendering an IHTMLElement to a Image File Using GDI+

我最新发表在codeproject上的文章:http://www.codeproject.com/vcpp/gdiplus/WebPageSnapshot.asp...
  • RichardSundusky
  • RichardSundusky
  • 2006年12月05日 14:46
  • 2017

从csdn的原创文章被扒说起

我居然都6年---不在csdn发文了.. 只是,我已经没有太多兴趣使用阿里,如果不是被阿里收购的万网有我几个域名,我会永远afk阿里。更别谈什么打败阿里。...
  • loadfuture
  • loadfuture
  • 2017年03月07日 17:33
  • 225

百度识图 图片的伪原创 【防图片侵权】

经初步测试,Google的图片识别能力强于百度,但Google在国内的使用不便,被弱化,故以百度为重点进行检验。      先从网上随机下载一“美女”图片,然后,用系统自带的“画图”软件及“美图秀...
  • QQ39921050
  • QQ39921050
  • 2014年11月22日 09:08
  • 1747
内容举报
返回顶部
收藏助手
不良信息举报
您举报文章:java中文问题(原创)
举报原因:
原因补充:

(最多只允许输入30个字)