【问题标题】:Parsing with lxml and xpath使用 lxml 和 xpath 进行解析
【发布时间】:2017-05-13 23:19:30
【问题描述】:

我正在尝试解析网站的特定表格

在这个网站上,我需要在 python 上使用 xmll 和 xpath 获取列(姓名和职务、职业、级别)。

到目前为止,我有这个代码:

import lxml.html
import requests
from lxml import html


url = "http://www.tibia.com/community/?subtopic=guilds&page=view&GuildName=Black%20Widow"
html = lxml.html.parse(url)
list = html.xpath("//table[@class='TableContent'][1]/tr/td[2]/text()")

list 假设给我第一列“名称和标题”的文本,但我收到的是一个完整的列表 '\xa0'

我确实使用HTML agility pack 在 vb.net 上编写了相同的代码,并且运行流畅,我可以在此处发布 vb.net 应用程序的代码,以便您更好地了解我想要做什么。

【问题讨论】:

    标签: python xpath lxml


    【解决方案1】:

    如果您需要从"Name and Title" 列中获取值,您可以尝试以下XPath

    //table[@class='TableContent']//td/a/text()
    

    另外请注意,您不应使用 "list" 作为变量名,因为它是 Python 内置类的名称

    【讨论】:

    • 非常好,这就是我正在寻找的,现在我将开始研究如何将这些信息传递给 mysql 数据表:D
    猜你喜欢
    • 2012-08-23
    • 1970-01-01
    • 1970-01-01
    • 2010-12-07
    • 2016-05-13
    • 2012-07-12
    • 2016-02-20
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多