【发布时间】:2022-08-18 22:59:12
【问题描述】:
现在我正在尝试验证它是否损坏并在 Excel 表中进行更新。为此,我需要从超链接中获取该文本,以便该链接易于理解。
他们将在 Excel 表中提供所有链接。
Link
https://www.dailythanthi.com/Careers
https://www.dailythanthi.com/Paper-Ad-Tariff
我需要像这样解析这个内容到excel表
Link text response code
https://www.dailyt... Careers 200
https://www.dailyt... Paper Advertisement 404
是否可以从他们提供的链接中提取文本链接?
-
是的,您可以与我们分享您的 Excel 表格吗
-
IIUC 你想访问所有网站,获取标题和响应代码并用它创建一个新的 csv?
-
如果您想为此获得解决方案,请告诉我您的问题可能随时关闭,因此无法回答,请通过
masterhimanshupoddar@gmail.com与我联系 -
text.split(\"/\')怎么样? IE。\"https://www.dailythanthi.com/Careers\".split(\'/\')[3]给Careers。但使用模块urllib.parse解析url 并拆分它可能会更好。
标签: python excel web-scraping beautifulsoup scrapy