【发布时间】:2013-06-10 13:32:44
【问题描述】:
我想创建一个网站,从其他网站中提取信息并将它们打印到我的网站中,我正在研究阶段,所以我想听听一些意见以及这个项目的最佳解决方案是什么?
听说Python使用解析器可以做到这一点,我只是想知道我应该走什么路径,应该使用哪种语言?。
【问题讨论】:
-
允许和鼓励使用其数据的网站提供比抓取更好的方法,例如 API、RSS 等。如果您必须抓取,则可能违反使用条款和/或版权规定。
-
我想从其他网站获取特定信息以总结它们并在我的网站中提供,如果用户想阅读全部信息,他将能够获得主要来源。我总是把所有的功劳归功于用户获得汇总信息的地方。我不知道这是否仍然违反版权规定。
标签: python database parsing web-scraping