我正在尝试从多个URL中提取特定的类.标签和类保持不变,但我需要我的python程序刮掉所有,因为我只是输入我的链接.
这是我的工作样本:
from bs4 import BeautifulSoup
import requests
import pprint
import re
import pyperclip
url = input('insert URL here: ')
#scrape elements
response = requests.get(url)
soup = BeautifulSoup(response.content, "html.parser")
#print titles only
h1 = soup.find("h1", class_= "class-headline")
print(h1.get_text())
Run Code Online (Sandbox Code Playgroud)
这适用于单个URL,但不适用于批处理.谢谢你的帮助.我从这个社区学到了很多东西.