python 重命名文件出现乱码_python处理文件名乱码

关于乱码的问题,遇到过很多次。尤其是在linux下……要是UTF能一统天下就好了。

以前也碰到过不少的文件名GBK乱码问题,曾经用python写过一个脚本解决,但是今天下了个ZIP的DOS游戏合集,却碰到挺多的问题。

于是又看了看PYTHON中编码的问题(看了又忘)。

我的程序中基本上都是清一色的#coding=utf-8。但是在写入XML的时候,又会遇到UTF的问题。

>>> u = "你好"

>>> u

'\xe4\xbd\xa0\xe5\xa5\xbd'

>>> i = u"我好"

>>> i

u'\u6211\u597d'

>>> type(i)

>>> type(u)

可以看出str和unicode是不一样的

>>> i.encode('utf8')

'\xe6\x88\x91\xe5\xa5\xbd'

>>> print i.encode('utf8')

我好

>>> print type(i.encode('utf8'))

搜到的信息是unicode似乎是字符串在计算机中的表示,跟编码无关。

我的理解是:在计算机中,那个字就是那个字,不管他是GBK还是UTF得来的;就好像我的脑子里面有只狗(unicode),他长的就是那样的──至于究竟是哪样的,你不是我,所以你不知道。而我如果要把它表示出来,那么我就要用各种方法,比如用GBK的铅笔画法,或者UTF的油画画法,这样,我脑子里那支unicode的狗就变成了存在于纸上(硬盘)上的那只狗。

而如果某一个人,它只能看懂油画(linux),当它碰到我用铅笔画的狗的时候,那么就产生了乱码。

这个时候,如果叫一个看得懂铅笔画的人(编码程序),先把那支铅笔画的狗,在脑子里面表示出来,再用UTF油画法把它画出来,这样先前那个人(linux),就可以明白了。

所以,当我遇到文件名编码错误的时候,就用这种思维方式来解决:

# 下面的例子中,u是乱码(gbk)

>>> u

'\xd3\xa2\xd0\xdb\xb4\xab\xcb\xb54\xd6\xec\xba\xec\xd1\xa9'

>>> print u

Ӣ�۴�˵4����ѩ

# u是铅笔画

>>> tu = u.decode('gbk')

>>> tu

u'\u82f1\u96c4\u4f20\u8bf44\u6731\u7ea2\u96ea'

# tu已经是脑子里想的那个东西了

>>> ttu = tu.encode('utf8')

>>> ttu

'\xe8\x8b\xb1\xe9\x9b\x84\xe4\xbc\xa0\xe8\xaf\xb44\xe6\x9c\xb1\xe7\xba\xa2\xe9\x9b\xaa'

>>> print ttu

英雄传说4朱红雪

>>> print type(ttu)

# u = u.decode('gbk').encode('utf8')

看起来是件很简单的事情啊,可是今天又碰到点小问题

'gbk' codec can't decode bytes in position xx

有点不明白,google了一下,发现有先人解决了,不用看英文资料啊,哈哈。

http://blog.donews.com/maverick/archive/2006/07/19/969198.aspx

原来是因为原来文件名编码乱的原因。

问题解决。

posted on

2007-10-09 14:39

AnewR

阅读(4829)

评论(0)

编辑

收藏

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
数据来源:中经数据库 主要指标110多个(全部都是纯粹的 市辖区 指标),大致是: GDP GDP增速 第一产业增加值占GDP比重 第二产业增加值占GDP比重 第三产业增加值占GDP比重 人均GDP 社会消费品零售总额 固定资产投资(不含农户) 新设外商投资企业数_外商直接投资 实际利用外资金额(美元) 一般公共预算收入 一般公共预算支出 一般公共预算支出_教育 一般公共预算支出_科学技术 金融机构人民币各项存款余额_个人储蓄存款 金融机构人民币各项存款余额 金融机构人民币各项贷款余额 规模以上工业企业单位数 规模以上工业企业单位数_内资企业 规模以上工业企业单位数_港澳台商投资企业 规模以上工业企业单位数_外商投资企业 规模以上工业总产值 规模以上工业总产值_内资企业 规模以上工业总产值_港澳台商投资企业 规模以上工业总产值_外商投资企业 规模以上工业企业流动资产合计 规模以上工业企业固定资产合计 规模以上工业企业利润总额 规模以上工业企业应交增值税 规模以上工业企业主营业务税金及附加 户籍人口数 年均户籍人口数 户籍人口自然增长率 第一产业就业人员占全部城镇单位就业人员比重 第二产业就业人员占全部城镇单位就业人员比重 第三产业就业人员占全部城镇单位就业人员比重 城镇非私营单位就业人员数 城镇非私营单位就业人员数_第一产业 城镇非私营单位就业人员数_第二产业 城镇非私营单位就业人员数_第三产业 城镇非私营单位就业人员数_农、林、牧、渔业 城镇非私营单位就业人员数_采矿业 城镇非私营单位就业人员数_制造业 城镇非私营单位就业人员数_电力、热力、燃气及水生产和供应业 城镇非私营单位就业人员数_建筑业 城镇非私营单位就业人员数_批发和零售业 城镇非私营单位就业人员数_交通运输、仓储和邮政业 城镇非私营单位就业人员数_住宿和餐饮业 城镇非私营单位就业人员数_信息传输、软件和信息技术服务业 城镇非私营单位就业人员数_金融业 城镇非私营单位就业人员数_房地产业 城镇非私营单位就业人员数_租赁和商务服务业 城镇非私营单位就业人员数_科学研究和技术服务业 城镇非私营单位就业人员数_水利、环境和公共设施管理业 城镇非私营单位就业人员数_居民服务、修理和其他服务业 城镇非私营单位就业人员数_教育 城镇非私营单位就业人员数_卫生和社会工作 城镇非私营单位就业人员数_文化、体育和娱乐业 城镇非私营单位就业人员数_公共管理、社会保障和社会组织 城镇非私营单位在岗职工平均人数 城镇就业人员数_私营企业和个体 城镇非私营单位在岗职工工资总额 城镇非私营单位在岗职工平均工资 城镇登记失业人员数 建成区面积 建设用地面积 建设用地面积_居住用地 液化石油气供气总量 液化石油气供气总量_居民家庭 人工煤气、天然气供气总量 人工煤气、天然气供气总量_居民家庭 液化石油气用气人口 人工煤气、天然气用气人口 城市公共汽电车运营车辆数 城市出租汽车运营车辆数 城市公共汽电车客运总量 道路面积 排水管道长度 建成区绿化覆盖面积 建成区绿化覆盖率 绿地面积 公园绿地面积 维护建设资金支出 土地面积 生活用水供水量 供水总量 全社会用电量 城乡居民生活用电量 工业生产用电量 房地产开发投资 房地产开发投资_住宅 限额以上批发和零售业法人单位数 限额以上批发和零售业商品销售总额 普通中学学校数 中等职业教育学校数 普通小学学校数 普通高等学校专任教师数 普通中学专任教师数 中等职业教育专任教师数 普通小学专任教师数 普通高等学校在校生数 普通中学在校生数 中等职业教育在校生数 普通小学在校生数 电视节目综合人口覆盖率 公共图书馆总藏量_图书 医疗卫生机构数_医院和卫生院 卫生人员数_执业(助理)医师 医疗卫生机构床位数_医院和卫生院 城镇职工基本养老保险参保人数 职工基本医疗保险参保人数 失业保险参保人数

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值