Hadoop中文编码乱码相关问题

最新推荐文章于 2022-04-24 18:50:14 发布

weixin_30596343

最新推荐文章于 2022-04-24 18:50:14 发布

阅读量81

点赞数

原文链接：http://www.cnblogs.com/lisi2016/p/6863936.html

版权

mapreduce程序处理GBK编码数据并输出GBK编码数据, hadoop涉及输出文本的默认输出编码统一用没有BOM的UTF-8的形式，但是对于中文的输出window系统默认的是GBK，有些格式文件例如CSV格式的文件用excel打开输出编码为没有BOM的UTF-8文件时，输出的结果为乱码，只能由UE或者记事本打开才能正常显示。因此将hadoop默认输出编码更改为GBK成为非常常见的需求，具体请参考以下这篇帖子http://www.aboutyun.com/thread-7358-1-1.html

转载于:https://www.cnblogs.com/lisi2016/p/6863936.html

weixin_30596343

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。