使用 Xpath (HtmlXPathSelector) 获取父文本和子文本

Mar*_*1ni 3 html python xpath scrapy

我正在抓取一个网站,我需要从这个 HTML 文档中获取数值:

<td>
<span style=" color: red; font-weight: bold;"> 1.950</span>
</td>
<td> 3.400</td>
Run Code Online (Sandbox Code Playgroud)

我需要提取 1.950 和 3.400,但我不知道该怎么做,当一个值仅在 a 中,而另一个值也有一个跨度时。有没有通用的方法来获取路径的父级和子级?我正在将scrapy框架与HtmlXPathSelector. 我可以将路径/td/text()用于一个,也可以/td/span/text()用于另一个,但我需要在一个查询中完成。如何做到这一点?

zoo*_*oom 5

您可以尝试:/td//text()选择每个文本节点的后代td