小编use*_*146的帖子

Pandas Wide_to_long,id变量需要唯一标识每一行

假设我有一个像这样的数据框

ID,Time1,Value1,Time2,Value2,Time3,Value3
1,2,1.1,3,1.2,4,1.3
1,5,2.1,6,2.2,7,2.3
Run Code Online (Sandbox Code Playgroud)

预期的数据框是这样的

ID,Time,Value
1,2,1.1
1,3,1.2
1,4,1.3
1,5,2.1
1,6,2.2
1,7,2.3
Run Code Online (Sandbox Code Playgroud)

如果该行具有唯一的 id,则pd.wide_to_long在这种情况下效果很好。

df = pd.wide_to_long(df, ['Time',Value],'ID','value', sep='', suffix='.+')\
    .reset_index()\
    .sort_values(['ID', 'Time'])\
    .drop('value', axis=1)\
    .dropna(how='any')
Run Code Online (Sandbox Code Playgroud)

但如果行的 ID 不唯一,如何解决这种情况

python dataframe pandas

5
推荐指数
1
解决办法
3359
查看次数

如何从 URL 中提取附加的凭据?

在这样的 URL 中: 'https://usertest:userpass@localhost:8080/mypath'. 如何在python中提取用户名和密码等信息?例如。我想从上面的 URL 中提取的信息是usertestuserpass。我可以使用正则表达式提取这些附加的网络凭据,例如用户名和密码,但这似乎有点复杂,我希望是否已经有一个内置的解决方案。有什么建议吗?

python python-requests

3
推荐指数
1
解决办法
506
查看次数

堆栈上的熊猫行为

让我假设我有

ID A1 B1  A2  B2
1  3  4   5   6
2  7  8   9   10
Run Code Online (Sandbox Code Playgroud)

我想使用pandas stack并希望实现类似的功能

ID A B
1  3 4
1  5 6
2  7 8
2  9 10
Run Code Online (Sandbox Code Playgroud)

但我得到的是

ID  A   B
1   3   4
2   7   8
1   5   6
2   9   10
Run Code Online (Sandbox Code Playgroud)

这就是我正在使用的

df.stack().reset_index().
Run Code Online (Sandbox Code Playgroud)

是否有可能使用Stack实现这样的东西?append()在熊猫中的方法做到这一点,但如果可能的话我想实现使用pandas stack()任何想法吗?

python dataframe pandas

2
推荐指数
1
解决办法
95
查看次数

将文件加载到pandas DataFrame中,没有列标题不起作用

我有一个文本文件,我想用熊猫阅读.后来我想以csv格式保存该文本文件,我还想在保存csv文件时添加列名.

当我的文件以csv格式保存时,第一行将被列名替换.这是我的代码

df = pd.read_csv('files.txt', delim_whitespace= True, header=0) 

d = dict(zip(df.columns[::],
         ['Column{}'.format(x) for x in range(len(df.columns[::]))]))
Run Code Online (Sandbox Code Playgroud)

最后,我想重命名列名称,除了我的新列名替换第一行外,一切正常

df = df.rename(columns = d)
df.to_csv('test.csv', index= 0)
Run Code Online (Sandbox Code Playgroud)

我不确定为什么我的第一行被我的列名替换.

python dataframe pandas

2
推荐指数
1
解决办法
1456
查看次数

什么是pandas dataframe.ne方法以及为什么使用它?

当我检查这种pandas dataframe.ne方法时,文档说它是一个包装,可以进行灵活比较。我在熊猫文档中找不到任何适当的示例。为什么我们要使用它,df.ne以及如何在进行数据操作时使它变得更容易或更灵活?是否可以给我一个使用df.ne或不df.ne使用相同方法的示例,这将有助于我理解?

python dataframe pandas

2
推荐指数
1
解决办法
953
查看次数

如果索引不同,如何在Pandas中停止移动列

data喜欢这个.

在此输入图像描述 .

我想pandas shift在a之间使用和减去值column.这是code我正在使用的.

df['Difference'] = (df['A'] - df['A'].shift(-1))
Run Code Online (Sandbox Code Playgroud)

这是output我得到的(如预期的那样).

在此输入图像描述

如何防止pandas从之间减去columns如果index ( Id)是不同的.我只想减去它index是否相同.我的欲望输出是这样的.使用df.shift(-1, axis = 0)也没有解决. 在此输入图像描述

有什么建议?

python dataframe pandas

1
推荐指数
1
解决办法
116
查看次数

复杂的 json 到 Pandas 数据框

有很多关于 json to pandas 数据框的问题,但没有一个能解决我的问题。我正在练习这个看起来像这样的复杂 json 文件

{
  "type" : "FeatureCollection",
  "features" : [ {
    "Id" : 265068000,
    "type" : "Feature",
    "geometry" : {
      "type" : "Point",
      "coordinates" : [ 22.170376666666666, 65.57273333333333 ]
    },
    "properties" : {
      "timestampExternal" : 1529151039629
    }
  }, {
    "Id" : 265745760,
    "type" : "Feature",
    "geometry" : {
      "type" : "Point",
      "coordinates" : [ 20.329506666666667, 63.675425000000004 ]
    },
    "properties" : {
      "timestampExternal" : 1529151278287
    }
  } ]
}
Run Code Online (Sandbox Code Playgroud)

我想使用pd.read_json()我的主要目标将这个 json 直接转换为 Pandas 数据帧,我的主要目标是提取 Id、坐标和时间戳外部。由于这是非常复杂的 …

python json dataframe pandas

1
推荐指数
1
解决办法
948
查看次数

标签 统计

python ×7

dataframe ×6

pandas ×6

json ×1

python-requests ×1