使用字典中的映射值添加新的pandas列

Question

使用字典中的映射值添加新的pandas列

我正在尝试做一些在熊猫中应该非常简单的事情,但它似乎不过了.我正在尝试将列添加到现有的pandas数据帧,该数据帧是基于另一个(现有)列的映射值.这是一个小测试用例:

import pandas as pd
equiv = {7001:1, 8001:2, 9001:3}
df = pd.DataFrame( {"A": [7001, 8001, 9001]} )
df["B"] = equiv(df["A"])
print(df)

Run Code Online (Sandbox Code Playgroud)

我希望以下结果:

      A   B
0  7001   1
1  8001   2
2  9001   3

Run Code Online (Sandbox Code Playgroud)

相反,我得到一个错误告诉我,equiv不是一个可调用的函数.很公平,它是一本字典,但即使我将它包装在一个函数中,我仍然会感到沮丧.所以我尝试使用似乎与其他操作一起使用的map函数,但它也被使用字典击败了:

df["B"] = df["A"].map(lambda x:equiv[x])

Run Code Online (Sandbox Code Playgroud)

在这种情况下,我只得到KeyError:8001.我已经阅读了文档和以前的帖子,但还没有发现任何暗示如何将字典与pandas数据帧混合的内容.任何建议将不胜感激.

Answer 1

CT *_*Zhu 69

正确的做法是df["B"] = df["A"].map(equiv).

In [55]:

import pandas as pd
equiv = {7001:1, 8001:2, 9001:3}
df = pd.DataFrame( {"A": [7001, 8001, 9001]} )
df["B"] = df["A"].map(equiv)
print(df)
      A  B
0  7001  1
1  8001  2
2  9001  3

[3 rows x 2 columns]

Run Code Online (Sandbox Code Playgroud)

考虑到以下示例,它将处理密钥不存在的情况:

In [56]:

import pandas as pd
equiv = {7001:1, 8001:2, 9001:3}
df = pd.DataFrame( {"A": [7001, 8001, 9001, 10000]} )
df["B"] = df["A"].map(equiv)
print(df)
       A   B
0   7001   1
1   8001   2
2   9001   3
3  10000 NaN

[4 rows x 2 columns]

Run Code Online (Sandbox Code Playgroud)

我总是用这种方法收到这个警告。解决办法是什么？？？？SettingWithCopyWarning：尝试在 DataFrame 切片的副本上设置值。尝试使用 .loc[row_indexer,col_indexer] = value 代替请参阅文档中的警告：http://pandas.pydata.org/pandas-docs/stable/user_guide/indexing.html#returning-a-view-versus-a -从 sys.path 中删除 cwd 后复制。 (3认同)
如果你的数据是字符串而不是int,有没有办法做到这一点？这只是给我NaNs字符串. (2认同)
如果你的“equiv”字典有列表而不是整数怎么办？如何只映射该列表的第 n 个元素？ (2认同)

归档时间：	11 年，7 月前
查看次数：	43720 次
最近记录：	9 年，11 月前