【发布时间】:2018-04-02 02:19:12
【问题描述】:
我对网络抓取非常陌生,在从 nba.com 抓取一些 NBA 球员数据时遇到了一些麻烦。我首先尝试使用 bs4 抓取页面,但遇到了一个问题,经过一些研究,我认为这是由于我阅读的文章中的“XHR”造成的。我能够找到 json 格式数据的网址,但我的 python 程序似乎陷入困境,并且从不加载数据。再次,我在网络抓取方面很新,但我想看看我是否在这里偏离轨道......有什么建议吗?谢谢! (代码如下)
import requests
import json
url = "http://stats.nba.com/stats/leaguedashplayerstats?College=&Conference=&Country=&DateFrom=&DateTo=&Division=&DraftPick=&DraftYear=&GameScope=&GameSegment=&Height=&LastNGames=0&LeagueID=00&Location=&MeasureType=Base&Month=0&OpponentTeamID=0&Outcome=&PORound=0&PaceAdjust=N&PerMode=PerGame&Period=0&PlayerExperience=&PlayerPosition=&PlusMinus=N&Rank=N&Season=2017-18&SeasonSegment=&SeasonType=Regular+Season&ShotClockRange=&StarterBench=&TeamID=0&VsConference=&VsDivision=&Weight="
resp = requests.get(url=url)
data = json.loads(resp.text)
print(data)
【问题讨论】:
-
为什么不去图书馆寻求帮助呢? github.com/seemethere/nba_py 或者至少看看他们是怎么做到的?
-
还没找到。。谢谢看看!
标签: python json web-scraping python-requests