【问题标题】:Extracting image links from the webpage using Python使用 Python 从网页中提取图像链接
【发布时间】:2017-03-09 14:48:14
【问题描述】:

我找到了这个查询 Extract image links from the webpage using Python

如果图像也可以由数字和小写字母组成,有人可以告诉语法(关于第一个答案)吗?

每个图片名称都是由大写字母组成的缩写,所以...

for link in re.findall('http://sports.cbsimg.net/images/nba/logos/30x30/[A-Z]*.png', source):

【问题讨论】:

  • 而不是这个 [A-Z]* 使用 [A-Za-z0-9]+

标签: python html python-2.7


【解决方案1】:

您需要了解正则表达式的工作原理。问题代码中的 [A-Z]* 表示:“每个名称都带有大写字母,无论大写字母的数量是多少”。

在这里您可以找到有关如何使用正则表达式的 python 2.7 和 3.X 的文档。

例如,如果您将 [A-Z]* 替换为 .*,您将获得所有 .png 格式的图像。

for link in re.findall('http://sports.cbsimg.net/images/nba/logos/30x30/.*\.png', source):

\.png 上的反斜杠会转义点,因为否则这可能是每个字符。如果您只需要处理大写/小写字母和数字,您也可以这样做:

for link in re.findall('http://sports.cbsimg.net/images/nba/logos/30x30/\w*\.png', source):

这将允许 A-Z + a-z + 0-9 + _

希望这会对你有所帮助。

【讨论】:

    猜你喜欢
    • 2012-07-06
    • 2019-04-12
    • 2022-06-15
    • 1970-01-01
    • 1970-01-01
    • 2022-01-13
    • 2011-04-14
    • 2023-03-18
    • 1970-01-01
    相关资源
    最近更新 更多