【发布时间】:2017-10-23 21:56:39
【问题描述】:
Python3 是否有基于 JavaScript 的非 Selenium 抓取库?我正在尝试抓取https://www.mailinator.com/v2/inbox.jsp?zone=public&query=test,但收件箱中加载了 JavaScript。我不想使用 Selenium 的原因是我不希望它在运行时打开一个窗口。
这是我的非工作代码:
import requests
from bs4 import BeautifulSoup as soup
INBOX = "https://www.mailinator.com/v2/inbox.jsp?zone=public&query={}"
def check_inbox(name):
stuff = soup(requests.get(INBOX.format(name)).text,"html.parser")
print(stuff.find("ul",{"class":"single_mail-body"}))
check_inbox("retep")
是否存在这样的库?
在 Selenium 之外,我无法通过 Google 搜索 python 3 javascript scraper 找到任何内容。
【问题讨论】:
-
@Hum4n01d 这是python3,不是python。
-
我不明白为什么会有所作为。
-
语法不同,库不兼容
-
好的,但总体而言,解决方案仍然是相同的。在开始抓取之前,您需要一个使用 JavaScript 呈现页面的库。