【发布时间】:2013-04-05 12:06:24
【问题描述】:
我想获取某个 HTML 标记中的文本。它看起来像:
<div id="data123">data1: value1<br>data2: value2<br> data3: value</div>
我的代码如下:
html_page = Nokogiri::HTML open 'my_url'
who_is_raw = html_page.css('div#data123')[0] #.text
我得到了<div> 标记中没有<br> 标记的文本或整个<div> 和所有<br>。但是,我只想要其中的 <div> 标记和 <br> 标记中的文本。
我该怎么做?
【问题讨论】: