【问题标题】:Extract HTML of a Scraped Page Using PHP's DOM使用 PHP 的 DOM 提取抓取页面的 HTML
【发布时间】:2011-11-14 00:25:03
【问题描述】:

是否可以从通过 PHP 的 DOM 工具提取的 HTML sn-p 的内容创建 HTML 输出(例如 $div = $dom->getElementsByTagName('table')->item(0);)这样创建的 HTML 只包含具有指定标签名称的元素及其后代?

否则,是否有任何其他方法可以轻松地从页面的完整 HTML 中提取 HTML 的 sn-p?我只想提取我抓取的页面的第一个表格,并仅显示该表格及其内容。

【问题讨论】:

    标签: php html dom web-scraping


    【解决方案1】:

    是的,您可以将节点传递给DOMDocument::saveXML()

    echo $dom->saveXml($div);
    

    然后会给你节点的outerHTML

    【讨论】:

      猜你喜欢
      • 2011-12-10
      • 2011-04-26
      • 1970-01-01
      • 2021-05-18
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-06-08
      • 2012-11-24
      相关资源
      最近更新 更多