Pandas:计算连续的重复项(不使用循环)并将列添加到原始 DataFrame

Cyr*_* YU 3 python dataframe pandas

import pandas as pd
value = [1,1,2,2,2,1,2,2,2,3,3,4]
df = pd.DataFrame(value)

df['count'] = [2,2,3,3,3,1,3,3,3,2,2,1]
Run Code Online (Sandbox Code Playgroud)

我想生成“计数”列,但不使用循环,因为原始数据很大。

有没有函数或其他有效的方法来做到这一点?

jez*_*ael 5

用于由sGroupBy.transform填充的新列以及由d 列使用( )创建的帮助程序,并添加连续组:countSeriesshiftne!=cumsum

df['count'] = df.groupby(df[0].ne(df[0].shift()).cumsum())[0].transform('size')
print (df)
    0  count
0   1      2
1   1      2
2   2      3
3   2      3
4   2      3
5   1      1
6   2      3
7   2      3
8   2      3
9   3      2
10  3      2
11  4      1
Run Code Online (Sandbox Code Playgroud)