【发布时间】:2011-06-10 06:22:54
【问题描述】:
在过去的几个小时里,我一直在尝试编写一个程序来完成我认为非常简单的任务:
- 程序要求用户输入(假设类型为“幸福”)
- 程序使用这种格式查询 thinkexist 网站(“http://thinkexist.com/search/searchQuotation.asp?search=USERINPUT”)
- 程序从网站返回第一个报价。
我尝试过将 Xpath 与 lxml 一起使用,但没有经验,并且每个构造都返回一个空白数组。
引用的实际内容似乎包含在“sqq”类中。
如果我通过 Firebug 浏览该站点,单击 DOM 选项卡,它似乎引用在 textNode 属性“wholeText”或“textContent”中——但我不知道如何以编程方式使用该知识。
有什么想法吗?
【问题讨论】:
标签: python screen-scraping screen lxml web-scraping