Pandas数据合并:如何指定列进行merge?

在数据分析中,经常需要对来自不同数据源的表进行合并操作。Pandas提供了强大的merge方法实现表合并,我们可以通过指定columns进行指定列上的合并。

假设有两张表df1和df2:

df1 = pd.DataFrame({
    'col1': ['a', 'b', 'c'],
    'col2': [1, 2, 3]
})

df2 = pd.DataFrame({
    'col1': ['a', 'b', 'c'],
    'col3': [4, 5, 6] 
})


要在col1列上进行合并,可以这样写:

pd.merge(df1, df2, left_on='col1', right_on='col1')


输出:
   col1  col2  col3
0     a     1   4 
1     b     2   5 
2     c     3   6
可以看到,df1和df2在col1列上的相同值进行了合并,而其他列都被保留了下来。
除了通过列名指定,也可以直接传入列对象:

pd.merge(df1, df2, left_on=df1['col1'], right_on=df2['col1'])


效果相同。
如果两表的合并列名不同,也可以分别指定:

df3 = pd.DataFrame({
    'col_1': ['a', 'b', 'c'],
    'col3': [7, 8, 9]
})

pd.merge(df1, df3, left_on='col1', right_on='col_1')


这样就可以实现通过指定不同的列名进行合并。
综上,Pandas的merge方法提供了强大的表合并功能,我们可以通过指定left_on和right_on实现指定列进行合并,解决由于列名不同而无法直接合并的问题。

  • 0
    点赞
  • 6
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

devid008

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值