【发布时间】:2017-06-20 18:15:57
【问题描述】:
我正在尝试通过 R 抓取心理治疗师个人资料的网页。
我的目标是获取显示为链接的治疗师的电子邮件。 页面示例:http://academyofct.site-ym.com/members/?id=44410428
浏览器将这段代码显示为:
<a href="mailto:abonfil@cogbtherapy.com">abonfil@cogbtherapy.com</a>
但是当我下载页面(通过 Ctrl+S)进行解析和获取电子邮件地址时,这部分代码会从 html 文件中消失。
谁能解释一下,有什么问题吗?以及如何获取提取电子邮件的完整网页?
谢谢!
【问题讨论】:
标签: html web-scraping html-parsing