小编lar*_*lie的帖子

合并两个pandas数据帧会产生"重复"列

我正在尝试合并两个包含相同键列的数据帧.其他一些列也有相同的标题,虽然不是相同数量的行,并且在合并这些列之后,使用postscript _x,_y等对原始标题进行"复制".

有谁知道如何让pandas删除下面示例中的重复列?

这是我的python代码:

import pandas as pd

holding_df = pd.read_csv('holding.csv')
invest_df = pd.read_csv('invest.csv')

merge_df = pd.merge(holding_df, invest_df, on='key', how='left').fillna(0)
merge_df.to_csv('merged.csv', index=False)
Run Code Online (Sandbox Code Playgroud)

CSV文件包含以下内容:

左数据帧的第一行(holding_df)

key, dept_name, res_name, year, need, holding
DeptA_ResA_2015, DeptA, ResA, 2015, 1, 1
DeptA_ResA_2016, DeptA, ResA, 2016, 1, 1
DeptA_ResA_2017, DeptA, ResA, 2017, 1, 1
...
Run Code Online (Sandbox Code Playgroud)

右数据帧(invest_df)

key, dept_name, res_name, year, no_of_inv, inv_cost_wo_ice
DeptA_ResA_2015, DeptA, ResA, 2015, 1, 1000000
DeptA_ResB_2015, DeptA, ResB, 2015, 2, 6000000
DeptB_ResB_2015, DeptB, ResB, 2015, 1, 6000000
...
Run Code Online (Sandbox Code Playgroud)

合并结果

key, dept_name_x, res_name_x, year_x, …
Run Code Online (Sandbox Code Playgroud)

python pandas

8
推荐指数
2
解决办法
2万
查看次数

标签 统计

pandas ×1

python ×1