java 控制台编码_Java控制台输出的默认字符编码

小编典典

我假设您的控制台仍在cmd.exe下运行。我怀疑您的控制台真的希望使用UTF-8-我希望它真的是OEM

DOS编码(例如850或437)。

Java将在JVM初始化期间使用默认编码集对字节进行编码。

在我的电脑上复制:

java Foo

Java编码为Windows-1252;控制台解码为IBM850。结果: Mojibake

java -Dfile.encoding=UTF-8 Foo

Java编码为UTF-8;控制台解码为IBM850。结果: Mojibake

cat test.txt

cat将文件解码为UTF-8;cat编码为IBM850;控制台解码为IBM850。

java Foo | cat

Java编码为Windows-1252;cat解码为Windows-1252;cat编码为IBM850;控制台解码为IBM850

java -Dfile.encoding=UTF-8 Foo | cat

Java编码为UTF-8;cat解码为UTF-8;cat编码为IBM850;控制台解码为IBM850

cat的

此实现必须使用启发式方法来确定字符数据是否为UTF-8,然后将数据从UTF-8或ANSI(例如Windows-1252)转码为控制台编码(例如IBM850)。

可以使用以下命令确认:

$ java HexDump utf8.txt

78 78 c3 a4 c3 b1 78 78

$ cat utf8.txt

xxäñxx

$ java HexDump ansi.txt

78 78 e4 f1 78 78

$ cat ansi.txt

xxäñxx

该 猫 命令可以做出此决定,因为e4 f1不是有效的UTF-8序列。

您可以通过以下方法更正Java输出:

将控制台编码设置为系统ANSI值

使用控制台类型

使用一些希夫层,你与这样 的猫

HexDump 是一个简单的Java应用程序:

import java.io.*;

class HexDump {

public static void main(String[] args) throws IOException {

try (InputStream in = new FileInputStream(args[0])) {

int r;

while((r = in.read()) != -1) {

System.out.format("%02x ", 0xFF & r);

}

System.out.println();

}

}

}

2020-09-15

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值