【发布时间】:2017-02-07 22:54:35
【问题描述】:
为简洁起见,输入是一个长子字符串:
'这只是虚拟头信息 \n 有时更长,有时更短 \n 日期:1/1/2000 \n 时间:16:00:30 \n 测试名称:meow \n 周期:1 \n 10 15 3 \n 3 69 23 \n 233 33.440 2 \n 频道:HBO \n 周期:1 \n 3 4 5 3 \n 2 3 4 5'
*注意,浮动是制表符分隔的。
我想根据“循环:”进行解析。有时字符串出现一次,有时出现三次。重要数据总是在 Cycle 之后并以一个空白的新行结束。结果可能是列出的数据列表,例如:
[[10 15 3 3 60 23 233 33.440 2], [3 4 5 3 2 3 4 5]]
提前致谢。
编辑
stringlist = re.split(r'\t+', rawsqlstring)
long_data = []
cycle_regex = re.compile('Cycle: ')
for el in stringlist:
if channel_regex.match(el):
break
for el in stringlist:
if el.strip() == '\n':
break
long_data.append(el)
【问题讨论】:
-
你知道正则表达式吗?
-
是的,我用过几次。埃里克,你的方法是什么?
标签: python regex parsing substring