我有一个pandas数据框我想计算一个数字出现在每列的列中的频率
a b c d e
0 2 3 1 5 4
1 1 3 2 5 4
2 1 3 2 5 4
3 2 4 1 5 3
4 2 4 1 5 3
Run Code Online (Sandbox Code Playgroud)
这是我的代码不起作用
def equalsOne(x):
x[x.columns == 1].sum()
df1.apply(equalOne(), axis = 1)
Run Code Online (Sandbox Code Playgroud)
这是所需的输出
a 2
b 0
c 3
d 0
e 0
Run Code Online (Sandbox Code Playgroud) 使用Pandas或CSV模块将每行具有不同列数的CSV导入Pandas DataFrame的最佳方法是什么?
"H","BBB","D","Ajxxx Dxxxs"
"R","1","QH","DTR"," "," ","spxxt rixxls, raxxxd","1"
Run Code Online (Sandbox Code Playgroud)
使用此代码:
import pandas as pd
data = pd.read_csv("smallsample.txt",header = None)
Run Code Online (Sandbox Code Playgroud)
生成以下错误
Error tokenizing data. C error: Expected 4 fields in line 2, saw 8
Run Code Online (Sandbox Code Playgroud)