Python Beautiful Soup在div标签本身中提取数据

Joh*_*nyW 4 html python beautifulsoup html-parsing

我正在尝试使用Pythons beautifulSoup从HTML文件中提取数据。HTML的以下行是我感兴趣的那一行。

<div class="myself" title="Name@email.com [11:07:27 AM]">
     <nobr>Name</nobr></div>
Run Code Online (Sandbox Code Playgroud)

我想提取标题(带有电子邮件和时间戳)。我可以通过...访问课程

find('div', attrs={'class':'myself'}))
Run Code Online (Sandbox Code Playgroud)

我可以div从那里打印整个内容或div中标签中的信息,但是我不知道如何获取title它,因为它在同一div标签中

ale*_*cxe 5

可以以类似于字典的方式检索属性:

标签可以具有任意数量的属性。您可以通过将标签视为字典来访问标签的属性。

from bs4 import BeautifulSoup

soup = BeautifulSoup(data)
div = soup.find("div", class_="myself", title=True)
print(div["title"])
Run Code Online (Sandbox Code Playgroud)