2024年python3对文件编码的转换处理(1)

2401_84563179

于 2024-04-30 15:28:08 发布

阅读量398

点赞数 28

分类专栏：程序员文章标签： python php linux

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/2401_84563179/article/details/138347360

版权

在转换生产数据的时候还算好用，但有些字符还是无法很好的识别，导致转换失败。

在网上又看到了一个专门用来编码转换的包:codecs, 用法大同小异

示例二：

‘’’

遇到问题没人解答？小编创建了一个Python学习交流QQ群：778463939

寻找有志同道合的小伙伴，互帮互助,群里还有不错的视频学习教程和PDF电子书！

‘’’

import os, sys

import chardet

import codecs

source_file = sys.argv[1] # 源文件

dest_file = sys.argv[2] # 转后的目标文件

确定源文件字符编码

for row in open(source_file, ‘rb’):

tmp = chardet.detect(row)

language = tmp.get(“language”)

if language == ‘Chinese’:

charset = “GB18030”

else:

charset = “UTF-8”

break

将文件转换成GBK编码

fp = codecs.open(dest_file, ‘w’, encoding=“GB18030”) # 中文编码写入

for row in codecs.open(source_file, ‘r’, encoding=charset): # 指定编码读

fp.write(row)
fp.close()

通过 Unicode 编

最低0.47元/天解锁文章

关注

28
点赞
踩
29

收藏

觉得还不错? 一键收藏
0
评论
2024年python3对文件编码的转换处理(1)

在转换生产数据的时候还算好用，但有些字符还是无法很好的识别，导致转换失败。在网上又看到了一个专门用来编码转换的包:codecs, 用法大同小异‘’’遇到问题没人解答？小编创建了一个Python学习交流QQ群：778463939寻找有志同道合的小伙伴，互帮互助,群里还有不错的视频学习教程和PDF电子书！‘’’source_file = sys.argv[1] # 源文件dest_file = sys.argv[2] # 转后的目标文件。
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。