python按行拆分表格_在pandas数据框中将单元格拆分为多行

这适用于任何数量的列,例如这样。本质是带有的一点堆叠-堆叠功能str.split。

(df.set_index(['order_date', 'order_id'])

.stack()

.str.split(',', expand=True)

.stack()

.unstack(-2)

.reset_index(-1, drop=True)

.reset_index()

)

order_date order_id package package_code

0 20/5/2018 1 p1 #111

1 20/5/2018 1 p2 #222

2 20/5/2018 1 p3 #333

3 22/5/2018 3 p4 #444

4 23/5/2018 7 p5 #555

5 23/5/2018 7 p6 #666

还有另一个涉及的性能替代方案chain,但是您需要显式地链接并重复每列(很多列都有问题)。由于没有单一答案,因此请选择最适合您问题描述的内容。

细节

首先,将不被触及的列设置为索引。

df.set_index(['order_date', 'order_id'])

package package_code

order_date order_id

20/5/2018 1 p1,p2,p3 #111,#222,#333

22/5/2018 3 p4 #444

23/5/2018 7 p5,p6 #555,#666

接下来,stack行。

_.stack()

order_date order_id

20/5/2018 1 package p1,p2,p3

package_code #111,#222,#333

22/5/2018 3 package p4

package_code #444

23/5/2018 7 package p5,p6

package_code #555,#666

dtype: object

我们现在有一系列。因此请str.split使用逗号。

_.str.split(',', expand=True)

0 1 2

order_date order_id

20/5/2018 1 package p1 p2 p3

package_code #111 #222 #333

22/5/2018 3 package p4 None None

package_code #444 None None

23/5/2018 7 package p5 p6 None

package_code #555 #666 None

我们需要摆脱NULL值,因此stack再次调用。

_.stack()

order_date order_id

20/5/2018 1 package 0 p1

1 p2

2 p3

package_code 0 #111

1 #222

2 #333

22/5/2018 3 package 0 p4

package_code 0 #444

23/5/2018 7 package 0 p5

1 p6

package_code 0 #555

1 #666

dtype: object

我们快到了。现在我们希望索引的倒数第二层成为我们的列,因此使用unstack(-2)(unstack在倒数第二层)上的堆栈

_.unstack(-2)

package package_code

order_date order_id

20/5/2018 1 0 p1 #111

1 p2 #222

2 p3 #333

22/5/2018 3 0 p4 #444

23/5/2018 7 0 p5 #555

1 p6 #666

使用reset_index以下命令摆脱多余的最后一级:

_.reset_index(-1, drop=True)

package package_code

order_date order_id

20/5/2018 1 p1 #111

1 p2 #222

1 p3 #333

22/5/2018 3 p4 #444

23/5/2018 7 p5 #555

7 p6 #666

最后,

_.reset_index()

order_date order_id package package_code

0 20/5/2018 1 p1 #111

1 20/5/2018 1 p2 #222

2 20/5/2018 1 p3 #333

3 22/5/2018 3 p4 #444

4 23/5/2018 7 p5 #555

5 23/5/2018 7 p6 #666

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值