关于使用合并在熊猫中复制Excel的Index-Match功能的文章有好几篇,但是合并似乎并没有涵盖Excel的Index-Match的最基本功能之一。
我有一个可行的解决方法,但是我敢肯定有更好的方法。当然,我可能会缺少有关pandas.merge的明显信息。
假设我们有以下两个表格
t1
numbers letters
0 1623 a
1 3266 b
2 3672 c
t2
letters target
0 a ddd
1 a ddd
2 a ddd
3 b eee
4 b eee
5 b eee
6 c fff
7 c fff
8 c fff
Run Code Online (Sandbox Code Playgroud)
并且我们想向t1添加一列,该列根据t2.letters中的值简单地映射t2.target中的值以产生以下结果:
numbers letters target
0 1623 a ddd
1 3266 b eee
2 3672 c fff
Run Code Online (Sandbox Code Playgroud)
使用pandas.merge,似乎t2.target中的所有重复值都必须显示在结果DataFrame中,如下所示:
numbers letters target
0 1623 a ddd
1 1623 a ddd
2 1623 a ddd
3 3266 b …Run Code Online (Sandbox Code Playgroud)