【问题标题】:How to extract path names without including file names如何在不包含文件名的情况下提取路径名
【发布时间】:2018-04-18 13:58:45
【问题描述】:

有如下网址。

original = 'https://dev.s3.amazonaws.com/production/uploads/2017/11/filename.jpg'

我只想从中提取/production/uploads/2017/11
可以只提取文件名,提取包含文件名的路径,但是请告诉我是否有好的方法可以提取不包括文件名的路径。

original_image_name = original.split('/')[-1] # 'filename.jpg'

from urllib.parse import urlparse
original_image_url = urlparse(original)
original_image_path = original_image_url.path # '/production/uploads/2017/11/filename.jpg'

【问题讨论】:

    标签: python parsing url path


    【解决方案1】:

    你会得到预期的输出

    original = "https://dev.s3.amazonaws.com/production/uploads/2017/11/filename.jpg"
    
    test = original.split("/")
    test = test[3:]
    test = test[:-1]
    sd = '/'.join(test)
    print sd
    

    输出

    production/uploads/2017/11
    

    【讨论】:

      【解决方案2】:

      你可以使用:

      import os
      os.path.dirname(original_image_path)
      

      【讨论】:

        【解决方案3】:
        【解决方案4】:

        一种快速的方法是使用regular expressions,就像这样:

        (http[s]?:\/\/)?([^\/\s]+)(.*)
        

        观看现场演示:https://regex101.com/r/2jsyiI/2

        【讨论】:

          猜你喜欢
          • 1970-01-01
          • 2011-06-13
          • 1970-01-01
          • 1970-01-01
          • 2020-09-09
          • 2013-09-17
          • 2021-12-21
          相关资源
          最近更新 更多