【发布时间】:2013-08-22 17:54:38
【问题描述】:
我需要从文本文件中提取某些行。假设我正在寻找"abcd1234"。这四个数字每次都不同,但前四个字母保持不变。
这是我目前所拥有的:
infile = file ('//Users//Nhi//Documents//Gene List.rtf', 'r')
outfile = file ('//Users//Nhi//Documents//new.docx', 'w')
for line in infile:
outfile.write("|MmarC5_\d{4}")
infile.close()
outfile.close()
然而,输出的字面意思是"|MmarC5_\d{4}",而不是每次都不同的4个数字。
【问题讨论】:
-
如果您已经证明自己付出了一些努力来解决问题,那么获得帮助会更容易......
-
首先,Python 不会以 MS Word
.docx格式编写...,只需使用.txt。其次,使用re模块(参见docs 和Joran Beasley 的回答)。继续前进,更新您的问题,人们会帮助您找出不起作用的细节。