小编Agn*_*Lee的帖子

Pandas:在一行中将多列添加到数据框中

我来自 R 背景,想知道是否有一行代码可以像 dplyr 一样向 Pandas 中的现有数据帧添加几个新列。如果有这段代码:

import pandas as pd

df = pd.DataFrame({'a': range(1, 11)})

df['b'] = range(11, 21)
df['c'] = range(21, 31)
df['d'] = range(31, 40)
df['e'] = range(41, 50)
Run Code Online (Sandbox Code Playgroud)

有没有一种方法可以将所有列添加到 df 中?我在 R 中想要的一个例子是:

library(dplyr)

df <- data.frame('a' = 1:10)

df <- df %>% mutate(b = 11:20, c = 21:30, d = 31:40, e = 41:50)
Run Code Online (Sandbox Code Playgroud)

python dataframe pandas

3
推荐指数
1
解决办法
864
查看次数

Python:按组计算数据帧中的特定出现次数

假设我有一个 df:

df = pd.DataFrame({'id': [12, 35, 37, 67, 99, 78],
                  'product': ['banana', 'apple', 'banana', 'pear', 'banana', 'apple'],
                  'reordered': [1, 0, 0, 1, 1, 1]})


    id     product   reordered
0   12     banana    1
1   35     apple     0
2   37     banana    0
3   67     pear      1
4   99     banana    1
5   78     apple     1
Run Code Online (Sandbox Code Playgroud)

我想计算“产品”列中产品出现的次数,以及按产品分组的“重新排序”列中的值。期望的结果:

       product   count   reordered_0   reordered_1
   0   banana    3       1             2
   1   apple     2       1             1
   2   pear      1       1             0
Run Code Online (Sandbox Code Playgroud)

请指教

python count dataframe pandas

2
推荐指数
2
解决办法
66
查看次数

获取 Dataframe 中每个重复值序列的第一个值

假设我有 df:

df = pd.DataFrame({'Day': range(1, 21),
               'Col1' : ['A', 'A', 'A', 'B', 'B', 'B', 'B', 'C', 'C', 'A', 'A', 'A', 'A', 'A', 'D', 'B', 'B', 'E', 'E', 'A']})

    Day Col1
0     1    A
1     2    A
2     3    A
3     4    B
4     5    B
5     6    B
6     7    B
7     8    C
8     9    C
9    10    A
10   11    A
11   12    A
12   13    A
13   14    A
14   15    D
15   16    B
16 …
Run Code Online (Sandbox Code Playgroud)

python dataframe pandas

2
推荐指数
1
解决办法
654
查看次数

标签 统计

dataframe ×3

pandas ×3

python ×3

count ×1