【发布时间】:2018-01-06 16:30:01
【问题描述】:
我在抓取网页方面有一些非常基本的知识,但是我被困在一件事上。我正在使用 php simple html dom,并且正在努力从每个“li”标签中获取图像。
<ul class="slides">
<li>
<img src="www.webpage.com/oH7oCOEhQABNAE2hnTQ.jpg" draggable="false">
</li>
<li>
<img src="www.webpage.com/ooabIAkbadaaIEJnkka.jpg" draggable="false">
</li>
<li>
<img src="www.webpage.com/bEQLaooknOAEQlaihna.jpg" draggable="false">
</li>
</ul>
我可以使用以下代码轻松获得第一张图片:
$td = $d1->find('ul.slides li img',0);
if ($td != null){
$slides_image1 = trim($td->src) ;
}
但无法弄清楚如何获取任何其他图像。显然我需要去第一个'li'并检索该图像,然后是第二个'li'并检索该图像,等等......有人可以帮忙吗?
【问题讨论】:
-
你能给我们更多的源代码吗?我猜
$d1是DOMDocument。然后你可以只做$d1->getElementsByTagName("img")并得到所有的img-tags。
标签: php html dom web-scraping