数据抓取;使用 rvest 从表中提取链接

ZBa*_*auc 2 r web-crawler web-scraping rvest

我正在尝试从此表中提取所有玩家链接:

https://www.footballdb.com/players/players.html?letter=A

这是我的代码的样子:

library(rvest)

url <- "https://www.footballdb.com/players/players.html?letter=A"
webpage <- read_html(url)

webpage %>%
  html_nodes("table") %>%
  html_attr("href")
Run Code Online (Sandbox Code Playgroud)

这将返回一个 NA。我看过其他有类似问题的帖子,但我未能很好地理解答案以将它们应用于这个问题。任何解决方案和/或指导将不胜感激。谢谢。

SeG*_*eGa 5

我认为你必须刮得更深一些;)

webpage %>%
  html_nodes("table") %>%
  html_nodes("td") %>% 
  html_nodes("a") %>% 
  html_attr("href")
Run Code Online (Sandbox Code Playgroud)