我有一组字符串set1,并且所有字符串set1都有两个特定的子字符串,我不需要并且想要删除它们.
示例输入:
set1={'Apple.good','Orange.good','Pear.bad','Pear.good','Banana.bad','Potato.bad'}
基本上我希望从所有字符串中删除.good和.bad子串.
我尝试了什么:
for x in set1:
x.replace('.good','')
x.replace('.bad','')
Run Code Online (Sandbox Code Playgroud)
但这似乎根本不起作用.输出绝对没有变化,它与输入相同.我尝试使用for x in list(set1)而不是原来的,但这并没有改变任何东西.
我df通过使用以下命令合并2个列表创建了一个Dataframe :
import pandas as pd
df=pd.DataFrame({'Name' : list1,'Probability' : list2})
Run Code Online (Sandbox Code Playgroud)
但我想删除第一列(索引列)并将列称为Name第一列.我试过用del df['index']和index_col=0.但他们没有工作.我也检查了reset_index(),这不是我需要的.我想从像这样创建的Dataframe中完全删除整个索引列(如上所述).有人请帮忙!
我有一个DF看起来像这样的数据框(这是一个示例):
EQ1 EQ2 EQ3
0 Apple.fruit Oranage.eatable.fruit NaN
1 Pear.eatable.fruit Banana.fruit NaN
2 Orange.fruit Tomato.eatable Potato.eatable.vegetable
3 Kiwi.eatable Pear.fruit Cabbage.vegetable
<And so on.. It is a large Dataframe>
Run Code Online (Sandbox Code Playgroud)
我希望在每个元素中最后一次出现点之后删除所有.内容,DF并将其保存在不同的名称之下df_temp.
期望的输出:
EQ1 EQ2 EQ3
0 Apple Oranage.eatable NaN
1 Pear.eatable Banana NaN
2 Orange Tomato Potato.eatable
3 Kiwi Pear Cabbage
<And so on>
Run Code Online (Sandbox Code Playgroud)
这就是我的尝试:
df_temp=".".join(DF.split(".")[:-1]).
不幸的是,这似乎只适用于字符串而不是Dataframe.我是否需要稍微调整一下这条线以实现我想要的效果?有人请帮忙!