pandas 某一列分组，其他列合并成list

最新推荐文章于 2023-12-14 14:52:14 发布

lxp198837

最新推荐文章于 2023-12-14 14:52:14 发布

阅读量5.9k

点赞数 1

分类专栏： Python pandas

本文链接：https://blog.csdn.net/lxp198837/article/details/103593082

版权

Python 同时被 2 个专栏收录

6 篇文章

订阅专栏

pandas

1 篇文章

订阅专栏

pandas列转换为字典，但将相同第一列（键）的所有值合并为一个键

形式一：

import pandas as pd

# data
data = pd.DataFrame({'column1':['key1','key1','key2','key2'],
       'column2':['value1','value2','value3','value3']})
print(data)

# Grouped dict
data_dict = data.groupby('column1').column2.apply(list).to_dict() 

print(data_dict)

输出结果：
  column1 column2
0    key1  value1
1    key1  value2
2    key2  value3
3    key2  value3

{'key1': ['value1', 'value2'], 'key2': ['value3', 'value3']}

形式二：

import pandas as pd
# data
df = pd.DataFrame({'column1':['key1','key1','key2','key2'],
       'column2':['value1','value2','value1','value2'],
       'column3':['value11','value11','value22','value22'],
       'column4':['value44','value44','value55','value55']})

# Grouped dict
data_dict = df.groupby('column1').apply(lambda x: {col:x[col].tolist() for col in x.columns if col != 'column2'}).to_dict()
print(data_dict)

data_dict2 = df.groupby('column1').apply(lambda x: {col:x[col].tolist()[0] if col != 'column2' else x[col].tolist() for col in x.columns}).to_dict()
print(data_dict2)

输出结果：
#data_dict
{
    'key1': {
        'column1': ['key1', 'key1'], 
        'column3': ['value11', 'value11'], 
        'column4': ['value44', 'value44']
    }, 
    'key2': {
        'column1': ['key2', 'key2'], 
        'column3': ['value22', 'value22'], 
        'column4': ['value55', 'value55']
    }
}
#data_dict2
{
    'key1': {
        'column1': 'key1', 
        'column2': ['value1', 'value2'], 
        'column3': 'value11', 
        'column4': 'value44'
    }, 
    'key2': {
        'column1': 'key2', 
        'column2': ['value1', 'value2'], 
        'column3': 'value22', 
        'column4': 'value55'
    }
}