• 欢迎访问搞代码网站,推荐使用最新版火狐浏览器和Chrome浏览器访问本网站!
  • 如果您觉得本站非常有看点,那么赶紧使用Ctrl+D 收藏搞代码吧

pandas 实现某一列分组,其他列合并成list

python 搞代码 4年前 (2022-01-07) 24次浏览 已收录 0个评论
文章目录[隐藏]

这篇文章主要介绍了pandas 实现某一列分组,其他列合并成list的案例。具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧

pandas列转换为字典,但将相同第一列(键)的所有值合并为一个键

形式一:

 import pandas as pd # data data = pd.DataFrame({'column1':['key1','key1','key2','key2'], 'column2':['value1','value2','value3','value3']}) print(data) # Grouped dict data_dict = data.groupby('column1').column2.apply(list).to_dict() print(data_dict)

输出结果:

 column1 column2 0  key1 value1 1  key1 value2 2  key2 value3 3  key2 value3 {'key1': ['value1', 'value2'], 'key2': ['value3', 'value3']}

形式二:

 import pandas as pd # data df = pd.DataFrame({'column1':['key1','key1','key2','key2'], 'column2':['value1','value2','value1','value2'], 'column3':['value11','value11','value22','value22'], 'column4':['value44','value44','value55','value55']}) # Grouped dict data_dict = df.groupby('column1').apply(lambda x: {col:x[col].tolist() for col in x.columns if col != 'column2'}).to_dict() print(data_dict) data_dict2 = df.groupby('column1').apply(lambda x: {col:x[col].tolist()[0] if col != 'column2' else x[col].tolist() for col in x.columns}).to_dict() print(data_dict2)

输出结果:

 #data_dict { 'key1': { 'column1': ['key1', 'key1'], 'column3': ['value11', 'value11'], 'column4': ['value44', 'value44'] }, 'key2': { 'column1': ['key2', 'key2'], 'column3': ['value22', 'value22'], 'column4': ['value55', 'value55'] } } #data_dict2 { 'key1': { 'column1': 'key1', 'column2': ['value1', 'value2'], 'column3': 'value11', 'column4': 'value44' }, 'key2': { 'column1': 'key2', 'column2': ['value1', 'value2'], 'column3': 'value22', 'column4': 'value55' } }

补充:pandas中,利用groupby分组后,对字符串字段进行合并拼接

在pandas里对于数值字段而言,groupby后可以用sum()、max()等方法进行简单的处理,对于字符串字段, 如果把它们的值拼接在一起,可以用使用 str.cat() 和 lamda 方法。

如,将下面表格中的内容,对skill字段按照id进行分组合并

实现代码:

 import pandas as pd file_name='test.xlsx' df=pd.read_excel(file_name) data=df.groupby('id')['skill'].apply(lambda x:x.str.cat(sep=':')).reset_index() print(data) 

效果如下:

另,数据处理时,常常需要将某一列进行拆分,分列,替换等,相关的函数有str.split()、str.extract()、str.r来源gaodaima#com搞(代@码网eplace().

以上为个人经验,希望能给大家一个参考,也希望大家多多支持gaodaima搞代码网。如有错误或未考虑完全的地方,望不吝赐教。

以上就是pandas 实现某一列分组,其他列合并成list的详细内容,更多请关注gaodaima搞代码网其它相关文章!


搞代码网(gaodaima.com)提供的所有资源部分来自互联网,如果有侵犯您的版权或其他权益,请说明详细缘由并提供版权或权益证明然后发送到邮箱[email protected],我们会在看到邮件的第一时间内为您处理,或直接联系QQ:872152909。本网站采用BY-NC-SA协议进行授权
转载请注明原文链接:pandas 实现某一列分组,其他列合并成list

喜欢 (0)
[搞代码]
分享 (0)
发表我的评论
取消评论

表情 贴图 加粗 删除线 居中 斜体 签到

Hi,您需要填写昵称和邮箱!

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址