java中编码问题_Java中文&编码问题

本文详细介绍了Java中从源文件到数据库的编码转换过程,包括JVM启动时的区域设置、Java源文件的编译、文件读写、XML处理、字节数组转换、JDBC编码、WEB/SERVLET/JSP中的编码处理以及JNI和TUXEDO/JOLT的相关编码问题。还探讨了GBK、GB18030、UTF系列编码的特点及其在Java中的应用。
摘要由CSDN通过智能技术生成

Java字符编码转换过程说明

61497_2632642_1.jpg

常见问题

61497_2632642_2.jpg

JVM

JVM启动后,JVM会设置一些系统属性以表明JVM的缺省区域。

user.language,user.region,file.encoding等。 可以使用System.getProperties()详细查看所有的系统属性。

如在英文操作系统(如UNIX)下,可以使用如下属性定义强制指定JVM为中文环境 -Dclient.encoding.override=GBK -Dfile.encoding=GBK -Duser.language=zh -Duser.region=CN

.java-->.class编译

说明:一般javac根据当前os区域设置,自动决定源文件的编码.可以通过-encoding强制指定.

错误可能:gbk编码源文件在英文环境下编译,javac不能正确转换.曾见于java/jsp在英文unix下.

检测方法:写\u4e00格式的汉字,绕开javac编码,再在jvm中,将汉字作为int打印,看值是否相等;或直接以UTF-8编码打开.class文件,看看常量字符串是否正确保存汉字。

文件读写外部数据如文件经过读写和转换两个步骤,转为jvm所使用字符。InputStream/OutputStream用于读写原始外部数据,Reader/Writer执行读写和转换两个步骤。

1 文件读写转换由java.io.Reader/Writer执行;输入输出流 InputStream/OutputStream 处理汉字不合适,应该首选使用Reader/Writer,如 FileReader/FileWriter。

2 FileReader/FileWriter使用JVM当前编码读写文件.如果有其它编码格式,使用InputStreamReader/OutputStreamWriter

3 PrintStream有点特殊,它自动使用jvm缺省编码进行转换。

读取.properties文件propeties文件由Properties类以iso8859-1编码读取,因此不能在其中直接写汉字,需要使用JDK

的native2ascii工具转换汉字为\uXXXX格式。命令行:native2ascii –encoding GBK inputfile

outputfile

读取XML文件

1 XML文件读写同于文件读写,但应注意确保XML头中声明如 xml version=”1.0” encoding=”gb2312” ?>与文件编码保持一致。

2 javax.xml.SAXParser类接受InputStream作为输入参数,对于Reader,需要用org.xml.sax.InputSource包装一下,再给SAXParser。

3 对于UTF-8编码 XML,注意防止编辑器自动加上\uFFFE BOM头, xml parser会报告content is not allowed in prolog。

字节数组

1 使用 new String(byteArray,encoding) 和 String.getBytes(encoding) 在字节数组和

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值