【发布时间】:2023-04-07 08:08:01
【问题描述】:
我正在尝试使用以下代码使用 BeautifulSoup 抓取网页:
import urllib.request
from bs4 import BeautifulSoup
with urllib.request.urlopen("http://en.wikipedia.org//wiki//Markov_chain.htm") as url:
s = url.read()
soup = BeautifulSoup(s)
with open("scraped.txt", "w", encoding="utf-8") as f:
f.write(soup.get_text())
f.close()
问题在于它保存了Wikipedia's main page 而不是那篇特定的文章。为什么地址不起作用,我应该如何更改?
【问题讨论】:
标签: python python-3.x web-scraping beautifulsoup