【发布时间】:2010-05-20 01:09:05
【问题描述】:
大家好,我真的很想在抓取网站时理解正则表达式,我一直在我的代码中使用它来获取以下内容,但我被困在这里。我需要快速抓住这个:
http://www.example.com/online/store/TitleDetail?detail&sku=123456789
从此:
('<a href="javascript:if(handleDoubleClick(this.id)){window.location=\'http://www.example.com/online/store/TitleDetail?detail&sku=123456789\';}" id="getTitleDetails_123456789">\r\n\t\t\t \tcheck store inventory\r\n\t\t\t </a>', 1)
这就是我感到困惑的地方。有什么想法吗?
编辑:每个产品的 sku 编号都会发生变化,所以这对我来说是个麻烦
【问题讨论】:
-
你可能会发现 PyCon 2010 上的这个演讲很有趣 - pycon.blip.tv/file/3359320
-
谢谢克里斯蒂安,我一直在看这个。但我没有找到像你提供的那样好的提要。干杯!
标签: python regex screen-scraping