【发布时间】:2021-05-22 10:34:23
【问题描述】:
我有一个 python 脚本 bs4 scraper,它从我从文本文件中提供给它的 web 链接中抓取 mp4 播放器链接。循环正常运行,但在其中一个链接处停止。就像我在 6 个链接下面传递它一样,它们运行 3 个然后停止而没有任何错误。
这些是链接:link1、link2、link3、link4、link5、link6
这是我的代码:
from bs4 import BeautifulSoup
import requests
text_file = open(r"Python\Anime_Episodes_Links\Links2.txt","r",encoding="utf-8")
num_link = 1
for a in text_file:
source = requests.get(text_file.readline())
soup = BeautifulSoup(source.text, 'lxml')
contener = soup.find('div', {'id': 'episode-watch-content'})
server_links = contener.find('ul', {'id': 'episode-servers'})
epi_link = server_links.find('a')['data-ep-url']
print(str(num_link) + '-' + str(epi_link))
num_link = num_link + 1
print('DONE')
需要帮助来了解我的代码中的问题所在,即它没有针对所有 6 个问题完成。
【问题讨论】:
标签: python web-scraping beautifulsoup python-requests