【发布时间】:2019-11-06 06:32:16
【问题描述】:
我是 PHP 抓取的新手,所以如果我犯了任何愚蠢的错误,请原谅我。 我正试图从确实刮掉工作。我通过 curl 获取 HTML,然后使用 DOM 解析它。现在的问题是我想获得一个带有类名的 div,但它在表的行内。我不知道我做错了什么。 请帮忙。
libxml_use_internal_errors(true);
$dom = new DOMDocument;
@$dom->loadHTML($result);
$xpath = new DOMXpath($dom);
$obj = $dom->getElementById('resultsBody');
if (!empty($obj)) {
$obj = $obj->getElementsByTagName('div[@class="jobsearch-SerpJobCard"]');
$ob= $obj->item(0);
print $ob->nodeValue;
print_r($obj);
} else {
echo "No data found";
}
exit;
我们还可以获取特定的 div 及其 HTML 并保存在变量中以进一步获取其中的 div 吗?
【问题讨论】:
标签: php curl dom screen-scraping