python 在大文件里面删除某一行,比较有效率的方法

  用 python 处理一个文本时,想要删除其中中某一行,常规的思路是先把文件读入内存,在内存中修改后再写入源文件。

但如果要处理一个很大的文本,比如GB级别的文本时,这种方法不仅需要占用很大内存,而且一次性读入内存时耗费时间,还有可能导致内存溢出。

  所以,需要用另外一个思路去处理。

  我们可以使用 open() 方法把需要修改的文件打开为两个文件,然后逐行读入内存,找到需要删除的行时,用后面的行逐一覆盖。实现方式见以下代码。

 1 with open('file.txt', 'r') as old_file:
 2     with open('file.txt', 'r+') as new_file:
 3 
 4         current_line = 0
 5 
 6         # 定位到需要删除的行
 7         while current_line < (del_line - 1):
 8             old_file.readline()
 9             current_line += 1
10 
11         # 当前光标在被删除行的行首,记录该位置
12         seek_point = old_file.tell()
13 
14         # 设置光标位置
15         new_file.seek(seek_point, 0)
16 
17         # 读需要删除的行,光标移到下一行行首
18         old_file.readline()
19         
20         # 被删除行的下一行读给 next_line
21         next_line = old_file.readline()
22 
23         # 连续覆盖剩余行,后面所有行上移一行
24         while next_line:
25             new_file.write(next_line)
26             next_line = old_file.readline()
27 
28         # 写完最后一行后截断文件,因为删除操作,文件整体少了一行,原文件最后一行需要去掉
29         new_file.truncate()

 

转载于:https://www.cnblogs.com/Dreamer-qiao/p/7390469.html

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值