Joh*_*nyW 4 html python beautifulsoup html-parsing
我正在尝试使用Pythons beautifulSoup从HTML文件中提取数据。HTML的以下行是我感兴趣的那一行。
<div class="myself" title="Name@email.com [11:07:27 AM]">
<nobr>Name</nobr></div>
Run Code Online (Sandbox Code Playgroud)
我想提取标题(带有电子邮件和时间戳)。我可以通过...访问课程
find('div', attrs={'class':'myself'}))
Run Code Online (Sandbox Code Playgroud)
我可以div从那里打印整个内容或div中标签中的信息,但是我不知道如何获取title它,因为它在同一div标签中
标签可以具有任意数量的属性。您可以通过将标签视为字典来访问标签的属性。
from bs4 import BeautifulSoup
soup = BeautifulSoup(data)
div = soup.find("div", class_="myself", title=True)
print(div["title"])
Run Code Online (Sandbox Code Playgroud)