【发布时间】:2019-05-10 00:19:56
【问题描述】:
我正在尝试从这样的 URL 中提取一个数字: https://ghostbin.com/paste/dmjvt 我想提取数字 3 我设法用 beatifulsoup 从 \li 提取到 /li,我似乎无法设法做一个正则表达式来从 \a href 中提取这个单个数字,因为它后面可能有一些数字 什么是 python 中的正则表达式来完成这个? 谢谢
【问题讨论】:
-
好吧,我没有看到提供的足够信息。请添加足够的信息
-
那里缺少什么?我的工作块是ghostbin.com/paste/2hdyd,我想在 /page/ 和 /# 之前提取数字,但问题是, /page/ 之前可能有数字。然后如何使用 python 正则表达式提取它?
-
请将您链接到的数据添加到问题中。链接可能会过期,从而使您的问题对未来的读者毫无意义。
-
我试过了,但问题真的搞砸了,而且我设置了粘贴不会过期。
-
@j.doe 你可以看到这个regex101.com/r/7lafAJ/1
标签: python regex beautifulsoup