【发布时间】:2017-05-13 23:19:30
【问题描述】:
我正在尝试解析网站的特定表格
在这个网站上,我需要在 python 上使用 xmll 和 xpath 获取列(姓名和职务、职业、级别)。
到目前为止,我有这个代码:
import lxml.html
import requests
from lxml import html
url = "http://www.tibia.com/community/?subtopic=guilds&page=view&GuildName=Black%20Widow"
html = lxml.html.parse(url)
list = html.xpath("//table[@class='TableContent'][1]/tr/td[2]/text()")
list 假设给我第一列“名称和标题”的文本,但我收到的是一个完整的列表 '\xa0'
我确实使用HTML agility pack 在 vb.net 上编写了相同的代码,并且运行流畅,我可以在此处发布 vb.net 应用程序的代码,以便您更好地了解我想要做什么。
【问题讨论】: