我正在寻找一个可以从R中的URL中提取域名的函数.任何类似于R中的tldextract的函数?编辑:目前我正在使用以下方法:
domain=substr(as.character("www.google.com"),
which(strsplit("www.google.com",'')[[1]]=='.')[1]+1, nchar("www.google.com"))
Run Code Online (Sandbox Code Playgroud)
但我正在寻找一种可以节省编码工作量的预定义功能.
嗨,我有一个巨大的文件,我想只导入该文件的最后100行.我们如何使用read.csv()或任何替代方法来做到这一点?
我有一个数据框,其中一些列名称的格式为 . 格式。例如:Company.1 当我在 sqldf 函数中使用该列时,它会抛出错误
data=sqldf(select Company.1 from test)
Error in sqliteExecStatement(con, statement, bind.data) :
RS-DBI driver: (error in statement: near ".1": syntax error)
Run Code Online (Sandbox Code Playgroud)
有什么解决方法可以让我可以按原样使用列名称吗?
我有一个数据框,其中列出了列值,并且想要查找两列之间的差异,或者换句话说,我想查找 A 列中 B 列中不存在的所有元素。
data={'NAME':['JOHN','MARY','CHARLIE'],
'A':[[1,2,3],[2,3,4],[3,4,5]],
'B':[[2,3,4],[3,4,5],[4,5,6]]}
df=pd.DataFrame(data)
df=df[['NAME','A','B']]
#I'm able to concatenate
df['C']=df['A']+df['B']
NAME A B C
0 JOHN [1, 2, 3] [2, 3, 4] [1, 2, 3, 2, 3, 4]
1 MARY [2, 3, 4] [3, 4, 5] [2, 3, 4, 3, 4, 5]
2 CHARLIE [3, 4, 5] [4, 5, 6] [3, 4, 5, 4, 5, 6]
Run Code Online (Sandbox Code Playgroud)
有什么办法可以找出差异吗?
df['C']=df['A']-df['B']
Run Code Online (Sandbox Code Playgroud)
我知道我们可以使用df.apply一个函数,但逐行处理会运行缓慢,因为我有大约 400K 行。我正在寻找一种直接的方法,例如
df['C']=df['A']+df['B']
Run Code Online (Sandbox Code Playgroud)