【发布时间】:2015-08-08 04:00:15
【问题描述】:
我在 html 上使用 scrapy,例如:
<td nowrap="" valign="top" align="right">
<br>
Text is here.
<br>
Other text is here
<br>
</td>
td[1]/text()[1] 给我:
(empty line)
Text is here.
我尝试过 normalize-space,即 normalize-space(td[1]/text()[1]),当我在我的 firefox 扩展程序中测试时,它有效,但在 scrapy 中无效。我认为scrapy被 \n 绊倒并且它跳过(或者只需要第一行节点,这没什么)。我也尝试了一些“前面”和“后面”的代码,但我认为它可能被认为是一个元素,我的 DOM 说 nodeValue = "\nText is here" 有什么想法吗?,
【问题讨论】:
-
你还没有说出你真正期望或想要得到的结果。换句话说,“作品”是什么意思?你希望得到一个空字符串吗?您是否希望得到“文本在这里。其他文本在这里。”?还是有什么不同?
-
我认为我们需要一个新的首字母缩写词:WRDYW & WRDYG?你想要什么结果,得到了什么结果?