【发布时间】:2015-05-27 06:57:26
【问题描述】:
我有两个 url 一个是工作 url 另一个是页面已删除 url。工作 url 很好,但对于页面删除 url 而不是获取确切的页面内容 wget 接收 404
工作网址
import os
def curl(url):
data = os.popen('wget -qO- %s '% url).read()
print (url)
print (len(data))
#print (data)
curl("https://www.reverbnation.com/artist_41/bio")
输出:
https://www.reverbnation.com/artist_41/bio
80067
页面删除网址
import os
def curl(url):
data = os.popen('wget -qO- %s '% url).read()
print (url)
print (len(data))
#print (data)
curl("https://www.reverbnation.com/artist_42/bio")
输出:
https://www.reverbnation.com/artist_42/bio
0
我的长度为 0,但实时页面中有一些内容
如何在 wget 或 curl 中接收准确的内容
【问题讨论】:
标签: python-3.x curl web-scraping wget