Pandas 使用 groupby 中的计数创建新列 [英] Pandas create new column with count from groupby

查看:51
本文介绍了Pandas 使用 groupby 中的计数创建新列的处理方法,对大家解决问题具有一定的参考价值,需要的朋友们下面随着小编来一起学习吧!

问题描述

我有一个如下所示的 df:

I have a df that looks like the following:

id        item        color
01        truck       red
02        truck       red
03        car         black
04        truck       blue
05        car         black

我正在尝试创建一个如下所示的 df:

I am trying to create a df that looks like this:

item      color       count
truck     red          2
truck     blue         1
car       black        2

我试过了

df["count"] = df.groupby("item")["color"].transform('count')

但这并不是我想要的.

感谢任何指导

推荐答案

那不是新列,而是新 DataFrame:

That's not a new column, that's a new DataFrame:

In [11]: df.groupby(["item", "color"]).count()
Out[11]:
             id
item  color
car   black   2
truck blue    1
      red     2

要得到你想要的结果是使用reset_index:

To get the result you want is to use reset_index:

In [12]: df.groupby(["item", "color"])["id"].count().reset_index(name="count")
Out[12]:
    item  color  count
0    car  black      2
1  truck   blue      1
2  truck    red      2

要获得新列",您可以使用转换:

To get a "new column" you could use transform:

In [13]: df.groupby(["item", "color"])["id"].transform("count")
Out[13]:
0    2
1    2
2    2
3    1
4    2
dtype: int64

我建议阅读文档的split-apply-combine部分.

这篇关于Pandas 使用 groupby 中的计数创建新列的文章就介绍到这了,希望我们推荐的答案对大家有所帮助,也希望大家多多支持IT屋!

查看全文
登录 关闭
扫码关注1秒登录
发送“验证码”获取 | 15天全站免登陆