我来自 R 背景,想知道是否有一行代码可以像 dplyr 一样向 Pandas 中的现有数据帧添加几个新列。如果有这段代码:
import pandas as pd
df = pd.DataFrame({'a': range(1, 11)})
df['b'] = range(11, 21)
df['c'] = range(21, 31)
df['d'] = range(31, 40)
df['e'] = range(41, 50)
Run Code Online (Sandbox Code Playgroud)
有没有一种方法可以将所有列添加到 df 中?我在 R 中想要的一个例子是:
library(dplyr)
df <- data.frame('a' = 1:10)
df <- df %>% mutate(b = 11:20, c = 21:30, d = 31:40, e = 41:50)
Run Code Online (Sandbox Code Playgroud) 假设我有一个 df:
df = pd.DataFrame({'id': [12, 35, 37, 67, 99, 78],
'product': ['banana', 'apple', 'banana', 'pear', 'banana', 'apple'],
'reordered': [1, 0, 0, 1, 1, 1]})
id product reordered
0 12 banana 1
1 35 apple 0
2 37 banana 0
3 67 pear 1
4 99 banana 1
5 78 apple 1
Run Code Online (Sandbox Code Playgroud)
我想计算“产品”列中产品出现的次数,以及按产品分组的“重新排序”列中的值。期望的结果:
product count reordered_0 reordered_1
0 banana 3 1 2
1 apple 2 1 1
2 pear 1 1 0
Run Code Online (Sandbox Code Playgroud)
请指教
假设我有 df:
df = pd.DataFrame({'Day': range(1, 21),
'Col1' : ['A', 'A', 'A', 'B', 'B', 'B', 'B', 'C', 'C', 'A', 'A', 'A', 'A', 'A', 'D', 'B', 'B', 'E', 'E', 'A']})
Day Col1
0 1 A
1 2 A
2 3 A
3 4 B
4 5 B
5 6 B
6 7 B
7 8 C
8 9 C
9 10 A
10 11 A
11 12 A
12 13 A
13 14 A
14 15 D
15 16 B
16 …Run Code Online (Sandbox Code Playgroud)