vs下载python最后一点很慢-python读取大文件越来越慢的原因与解决

最新推荐文章于 2023-06-09 00:46:26 发布

weixin_37988176

最新推荐文章于 2023-06-09 00:46:26 发布

阅读量379

点赞数

背景：

今天同事写代码，用python读取一个四五百兆的文件，然后做一串逻辑上很直观的处理。结果处理了一天还没有出来结果。问题出在哪里呢？

解决：

1. 同事打印了在不同时间点的时间，在需要的地方插入如下代码:

print time.strftime('%Y-%m-%d %H:%M:%S',time.localtime(time.time()))

发现一个规律，执行速度到后面时间越来越长，也就是处理速度越来越慢。

2. 为什么会越来越慢呢？

1）可能原因1，GC 的问题，有篇文章里面写，python list append 的时候会越来越慢，解决方案是禁止GC:

使用 gc.disable（）和gc.enable（）

2）改完上面，仍然不行，然后看到一篇文章里面写，可能是因为 git 导致的，因为append 的时候 git 会不断同步，会出问题，于是删除 .git 文件夹，结果还是不行。

3）继续查询，发下一个及其有可能出问题的地方。dict 的 in dict.key()，判断 key 是否在 dict 里面，这个的效率是非常低的。看到一篇文章比较了效率：

① 使用 in dict.keys() 效率:

201988112032113.png?201978112056

② 使用 has_key() 效率:

201988112210551.png?201978112216

发现 has_key() 效率比较稳定。于是修改，问题解决。

后话：

最初的时候，的确是使用 has_key(), 结果后面上传代码的时候，公司代码检查过不了，提示不能使用这个函数，只能改成 in dict.key() 这种方式，为什么公司不让这么传呢？经过一番百度，发现原因所在：在 python3 中，直接将 has_key() 函数给删除了，所以禁止使用。那禁止了该怎么办呢？原来 python 中 in 很智能，能自动判断 key 是否在字典中存在。所以最正规的做法不是 has_key(), 更不是 in dict.keys(), 而是 in dict. 判断 key 在 map 中，千万别用 in dict.keys() ！！！

附录:

in、 in dict.keys()、 has_key() 方法实战对比:

>>> a = {'name':"tom", 'age':10, 'Tel':110}

>>> a

{'age': 10, 'Tel': 110, 'name': 'tom'}

>>> print 'age' in a

True

>>> print 'age' in a.keys()

True

>>>

>>> print a.has_key("age")

True

总结

以上就是这篇文章的全部内容了，希望本文的内容对大家的学习或者工作具有一定的参考学习价值，谢谢大家对脚本之家的支持。

参考资料:

weixin_37988176

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。