Python 从大型csv文件中提取感兴趣的行

Python 从大型csv文件中提取感兴趣的行
帮妹子处理一个2.xG 大小的 csv文件,文件太大,不宜一次性读入内存,可以使用open迭代器。

with open(filename,‘r’) as file
# 按行读取
for line in file:
process
或者简单点

for line in open(‘myfile.txt’,‘r’):
pass
需求是,提取时间在指定时间段的数据,另存一个文件。

全部代码如下

def is_between_time(str, start, end):
“”"
:param str: a line in data file : 8684496663,粤BC5948,2016-01-01 22:01:56,114.083448,22.531582,225,0,0,0,114075022530,114070022530,114.078316,22.534267,1463910,2016-01-01 22:25:59.772000
:param start: start point for example: 21:57:00
:param end: end point for example: 22:03:00
:return:
“”"
fields = str.split(’,’)
datetime = fields[2]
time = datetime.split(’ ')[1]
if time > start and time < end:
return True
else:
return False

file_to_read_path = “E:/P_CZCGPS_20160101.csv”
file_to_write = open(“E:/result.csv”, ‘w’)

read file and process

with open(file_to_read_path,‘r’) as file:
for line in file:
if is_between_time(line, “21:57:00”, “22:03:00”):
print(line)
file_to_write.write(line)

file_to_write.close()
1024节日快乐!
最后,小编想说:我是一名python开发工程师,整理了一套最新的python系统学习教程想要这些资料的可以关注私信小编“01”即可,希望能对你有所帮助

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值