python删除csv文件的一列并保存_Pyhton编程：Python读csv文件去掉一列后再写入新的文件...

weixin_39682940

于 2020-12-11 11:11:09 发布

阅读量806

点赞数

文章标签： python删除csv文件的一列并保存

本篇Pyhton编程教程将为大家讲解Pyhton编程的知识点，看完这篇文章会让你对Python编程的知识点有更加清晰的理解和运用。

用了两种方式解决该问题，都是网上现有的解决方案。

场景说明：

有一个数据文件，以文本方式保存，现在有三列user_id,plan_id,mobile_id。目标是得到新文件只有mobile_id,plan_id。

解决方案

方案一：用python的打开文件写文件的方式直接撸一遍数据，for循环内处理数据并写入到新文件。

代码如下：

def readwrite1( input_file,output_file):

f = open(input_file, 'r')

out = open(output_file,'w')

print (f)

for line in f.readlines():

a = line.split(",")

x=a[0] + "," + a[1]+"\n"

out.writelines(x)

f.close()

out.close()

方案二：用 pandas 读数据到 DataFrame 再做数据分割，直接用 DataFrame 的写入功能写到新文件

代码如下：

def readwrite2(inpu

t_file,output_file):

date_1=pd.read_csv(input_file,header=0,sep=',')

date_1[['mobile', 'plan_id']].to_csv(output_file, sep=',', header=True,index=False)

从代码上看，pandas逻辑更清晰。

下面看下执行的效率吧！

def getRunTimes( fun ,input_file,output_file):

begin_time=int(round(time.time() * 1000))

fun(input_file,output_file)

end_time=int(round(time.time() * 1000))

print("读写运行时间：",(end_time-begin_time),"ms")

getRunTimes(readwrite1,input_file,output_file) #直接撸数据

getRunTimes(readwrite2,input_file,output_file1) #使用dataframe读写数据

读写运行时间： 976 ms

读写运行时间： 777 ms

input_file 大概有27万的数据，dataframe的效率比for循环效率还是要快一点的，如果数据量更大些，效果是否更明显呢？

下面试下增加input_file记录的数量试试，有如下结果

input_filereadwrite1readwrite2

27W976777

55W19891509

110W43123158

从上面测试结果来看,dataframe的效率提高大约30%左右。

以上，关于Pyhton的全部内容讲解完毕啦，欢迎大家继续关注!更多关于Python的干货请关注职坐标Python频道!

weixin_39682940

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。