【发布时间】:2021-04-19 03:53:15
【问题描述】:
我正在尝试提取“10-K”网址并将其附加到以下站点的列表中:
https://www.sec.gov/Archives/edgar/data/320193/000091205701544436/0000912057-01-544436-index.htm
所以基本上我试图提取第一个下没有作为其子类别的第一个。
我正在尝试创建一个循环以在多个类似的链接中循环此代码,但我想我现在正在尝试首先解决此问题。
有什么想法吗?
【问题讨论】:
-
I'm trying to extract the first under the first that does not have as its sub category.=> 仍然不清楚您的预期结果。您能否提供您目前的工作以及您遇到的问题? -
如果要从源中提取href标签,请使用beautifulsoup4包。 pypi.org/project/beautifulsoup4