【问题标题】:Simple Dom Parser - stripping links and specific divs from the result简单的 Dom Parser - 从结果中剥离链接和特定的 div
【发布时间】:2014-05-25 14:28:37
【问题描述】:

我正在尝试解析来自特定 div 的一些内容并将其保存到外部文件。虽然这可行,但我无法做到以下

来自类league_container的div

  1. 删除类bar的所有div
  2. 删除所有链接。 (保留文本但删除 a 及其属性)

到目前为止我所拥有的是:

   <?php
    include( 'simple_html_dom.php'); 
    $html = file_get_html('https://some.domain.com/');

    $divContents = array();

    foreach ($html->find('div.league_container') as $div) 
    {
        $divContents[] = $div->outertext;
    }       


file_put_contents('parser/est-results.htm', implode(PHP_EOL, $divContents));
?>

任何帮助将不胜感激。

【问题讨论】:

    标签: php html parsing dom simpledom


    【解决方案1】:

    使用outertext =

    $div->outertext = '';
    $a->outertext = $a->text();
    

    【讨论】:

    • 回复坦克,我不确定这段代码将如何选择和删除具有“bar”类的 div?
    • 只需迭代$html-&gt;find('.bar')
    猜你喜欢
    • 1970-01-01
    • 2021-06-06
    • 2013-04-08
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2012-12-05
    相关资源
    最近更新 更多