【问题标题】:HTML table Scraping in PHP and DOMPHP 和 DOM 中的 HTML 表格抓取
【发布时间】:2018-01-13 10:34:32
【问题描述】:

我正在尝试从学校成绩服务器中提取学生成绩并将其存储在本地数据库中。我有以下 html 文件。我想报废 html 表数据并将其存储在 mysql 数据库中,如下代码所示。我需要有关如何解析 html DOm 并将其存储在 mysql 中的帮助。由于标签太多,我无法区分它们。

<table border="2">
    <tr>
        <td>Name: Shanthini</td>
        <td>Reg.No: 12345</td>
    </tr>
    <tr>
        <td>Maths</td>
        <td>89</td>
        <td>Pass</td>
    </tr>
    <tr>
        <td>English</td>
        <td>90</td>
        <td>Pass</td>
    </tr>
    <tr>
        <td>Chemistry</td>
        <td>89</td>
        <td>Pass</td>
    </tr>
</table>

我想这样存储:

任何人都可以帮助我使用 php 和 mysql 进行这种类型的爬网

【问题讨论】:

标签: php mysql dom web-crawler


【解决方案1】:

如果这是你只需要做一次的事情,并且你知道基本的 jquery 和基本的 css 选择器,你可以使用 QueryPath https://github.com/technosophos/querypath

加载 html 并使用类似于在 jquery 中所做的技术,但使用 QueryPath 对象。

如果您了解实际的 DOM 操作技术并安装了 node.js,那可能会更容易使用。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2013-12-26
    • 1970-01-01
    • 1970-01-01
    • 2017-02-21
    • 1970-01-01
    • 2017-06-08
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多