【发布时间】:2021-10-21 01:04:03
【问题描述】:
我只想从这里抓取字符串:
<br>
5 Brown Circle<br>
Alabaster,
AL
35007
我需要深入了解如何从 html doc 之后的上述部分中提取文本:
<tr class="prem-tr" id="10425" role="row">
<td>
<h4><a class="prem-result-link" href="/Search/Details/10425">Graham & Associates, CPAs</a></h4>
<a href="tel:+(205) 663-6673">(205) 663-6673</a>
<br>
5 Brown Circle<br>
Alabaster,
AL
35007
<div class="row result-btmRow">
<div class="col-sm-4">
<span class="result-dist"><small>Distance: 0.00 miles</small></span>
</div><!-- col6 -->
<div class="col-sm-8 result-actions">
<a id="WebsiteURL" class="visit-site" href="http://grahamandassociates.net" target="_blank">Visit Website</a>
<a class="send-email" href="/Search/Details/10425">Send a Message</a>
</div><!-- /col6 -->
</div><!-- /row -->
</td>
</tr>
预期输出:5 Brown Circle, Alabaster, AL 35007 仅使用 xpath 以及解释。
或
在 css 选择器中,它工作正常。谁能解释下面的代码?谢谢
" ".join([" ".join(el.root.strip().split()) for el in sel.css("td::text") if el.root.strip()])
【问题讨论】:
-
展示你的尝试
-
看看elementTree