【发布时间】:2020-01-31 19:27:30
【问题描述】:
我正在尝试在代码中抓取网站,但我会以表格格式。
$url='http://www.arbworld.net/en/moneyway';
libxml_use_internal_errors( true );
$dom=new DOMDocument;
$dom->validateOnParse=false;
$dom->recover=true;
$dom->strictErrorChecking=false;
$dom->loadHTMLFile( $url );
libxml_clear_errors();
$xp=new DOMXPath( $dom );
$col=$xp->query('//table[@class="grid"]/tr[@class="belowHeader"]/td');
if( $col->length > 0 ){
foreach( $col as $node )echo $node->textContent;
}
现在输出是这样的:
罗马尼亚联赛 I22.Dec 18:00:00 FCSBUniversitat2.063.33.999.9 %€ 2070.1 %€ 00 %€ 0€ 207 22.Dec 18:00:00 意大利甲级联赛 A22.Dec 11:30:00 亚特兰大AC米兰1.8844.499.7 %€ 21 5580.1 %€ 170.2 %€ 46€ 21 622 22.Dec 11:30:00 英格兰联赛 221.Dec 15:0 0:00
【问题讨论】:
标签: php html parsing web-scraping