【发布时间】:2018-07-03 13:13:36
【问题描述】:
如何多线程解析我正在解析的链接?
基本上我是在寻找链接,然后一一解析这些链接。
它正在这样做:
for link in links:
scrape_for_info(link)
链接包含:
https://www.xtip.co.uk/en/?r=bets/xtra&group=476641&game=312053910
https://www.xtip.co.uk/en/?r=bets/xtra&group=476381&game=312057618
...
https://www.xtip.co.uk/en/bets/xtra.html?group=477374&game=312057263
scrape_for_info(url) 看起来像这样:
def scrape_for_info(url):
scrape = CP_GetOdds(url)
for x in range(scrape.GameRange()):
sql_str = "INSERT INTO Scraped_Odds ('"
sql_str += str(scrape.Time()) + "', '"
sql_str += str(scrape.Text(x)) + "', '"
sql_str += str(scrape.HomeTeam()) + "', '"
sql_str += str(scrape.Odds1(x)) + "', '"
sql_str += str(scrape.Odds2(x)) + "', '"
sql_str += str(scrape.AwayTeam()) + "')"
cursor.execute(sql_str)
conn.commit()
我看到在抓取网站时使用了线程,但它主要用于抓取而不是解析。
我希望有人能教我如何比现在更快地解析。当我查看实时赔率时,我必须尽快更新
【问题讨论】:
标签: python multithreading beautifulsoup python-multiprocessing