【发布时间】:2015-12-25 01:55:56
【问题描述】:
我在一个变量中获取页面的源代码。
<!DOCTYPE html><html><head><title>Intro</title></head><body><a href='/name=t1.304.log'>Test</a>. </body></html>
我想从上面的行中提取t1.304.log。
我正在使用 print log_name.split(".log",1)[0] 但它正在获取我的第一部分。
【问题讨论】:
-
您能否通过从行中提取所需的字符串来详细说明您的意思?你想提取任何看起来像“something.log”的字符串吗?
-
是的,任何以 .log 结尾的字符串。它只会出现一次
-
“仅一次”是指只有第一个匹配的子字符串吗?还是要确保字符串只包含一个匹配项?
标签: python html html-parsing