【发布时间】:2021-01-11 11:09:50
【问题描述】:
我在 Python 3.9 中做一个网页抓取脚本。
我想从这个网站收集一些信息:https://www.matchendirect.fr/。 这个网站是法语的,但我不认为试图帮助我是一个真正的问题。
我需要的信息是鼠标悬停在“Pronostics des internautes”部分中显示的数组。 HTML 代码以:<table class="table table-bordered MEDtpro">
我已经在浏览器上重新创建了 cookie,以按照本文How to send cookies with urllib 上的答案模拟我的连接,但它不起作用。
这是我的代码:
#!/usr/bin/python3
# -*- coding: utf-8 -*-
import requests
cookies = {
'PHPSESSID': 'a2q4evve875s1ibamiqmc93ru6',
'c_compte_cle': '76598fbd4fe763e768dc79275c02e11f',
'c_compte_id':'311084',
'c_compte_pseudo':'foobar',
'c_compte_url_image':'%2Fimage%2Fcommun%2Fmembre-med-t16.png',
'c_coucours_promo':'3'
}
headers = {'User-Agent': 'Mozilla/5.0'}
link = "https://www.matchendirect.fr/live-score/caen-toulouse.html"
response = requests.get(link, cookies=cookies, headers=headers)
webpage = response.text
print("Success!") if webpage.find('<table class="table table-bordered MEDtpro">')>-1 else print("Failed!")
有人可以帮我解决这个问题吗?
此帐户是一个垃圾帐户,供想要测试的人使用。
【问题讨论】:
-
您是否在登录后尝试解析 HTML?
-
感谢您帮助我。我已编辑帖子以删除有关帐户名和密码的信息。顺便说一句,我会删除帐户。
标签: python python-3.x web-scraping python-requests