java难学还是pythonnanxue_Python比较忽略nan

假设您有一个具有nan值的数据帧:In [10]: df = pd.DataFrame(np.random.randint(0, 20, (10, 10)).astype(float), columns=["c%d"%d for d in range(10)])

In [10]: df.where(np.random.randint(0,2, df.shape).astype(bool), np.nan, inplace=True)

In [10]: df

Out[10]:

c0 c1 c2 c3 c4 c5 c6 c7 c8 c9

0 NaN 6.0 14.0 NaN 5.0 NaN 2.0 12.0 3.0 7.0

1 NaN 6.0 5.0 17.0 NaN NaN 13.0 NaN NaN NaN

2 NaN 17.0 NaN 8.0 6.0 NaN NaN 13.0 NaN NaN

3 3.0 NaN NaN 15.0 NaN 8.0 3.0 NaN 3.0 NaN

4 7.0 8.0 7.0 NaN 9.0 19.0 NaN 0.0 NaN 11.0

5 NaN NaN 14.0 2.0 NaN NaN 0.0 NaN NaN 8.0

6 3.0 13.0 NaN NaN NaN NaN NaN 12.0 3.0 NaN

7 13.0 14.0 NaN 5.0 13.0 NaN 18.0 6.0 NaN 5.0

8 3.0 9.0 14.0 19.0 11.0 NaN NaN NaN NaN 5.0

9 3.0 17.0 NaN NaN 0.0 NaN 11.0 NaN NaN 0.0

你想比较第0行和第8行。然后使用fillna并进行矢量化比较:

^{pr2}$

如果只想知道哪些列不同,可以使用生成的布尔数组索引列:In [14]: df.columns[df.iloc[0,:].fillna(0) != df.iloc[8,:].fillna(0)]

Out[14]: Index(['c0', 'c1', 'c3', 'c4', 'c6', 'c7', 'c8', 'c9'], dtype='object')

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值