【发布时间】:2012-12-14 00:51:41
【问题描述】:
我正在尝试从 Java 中的 http://www.amazon.com/gp/bestsellers/electronics 中提取 org.w3c.dom.NodeList。这是我用来在 Google Chrome JavaScript 控制台中显示结果的 XPath 语句:
$x("//div[@class='zg_itemRightDiv_normal']")
上述语句完美运行,但是当我使用 Java 的 javax.xml.xpath 和 org.w3c.dom 库时,我没有得到任何结果:
XPathExpression expr = xPath.compile("//div[@class='zg_itemRightDiv_normal']");
NodeList productNodes = (NodeList) expr.evaluate(doc, XPathConstants.NODESET);
// In the above productNodes definition, doc is a org.w3c.dom.DocumentFragment
System.out.println(productNodes.getLength()); // prints out '0'
我错过了什么?
【问题讨论】:
-
尝试给出完整路径....
标签: java xpath web-scraping