【发布时间】:2016-05-08 09:08:16
【问题描述】:
我有文本文件中的语料库,这些文本文件分为几个文件夹中的几个文本文件。我正在做的是计算它们的熵,但是很难将它们连接到一个文本文件中。我所做的如下所示。
filenames = ['BrownA1.txt', 'BrownB1.txt', 'BrownC1.txt'.....]
with open("C:/Python27/TRAINING.txt", 'w') as outfile:
for fname in filenames:
with open(fname) as infile:
for line in infile:
outfile.write(line)
但是这种方法需要很多时间。我有几乎数百个 txt 文件可供阅读。 像这样。 C:/Python27/acq/000916~012897, C:/Python27/alum/0009945~012875, C:/Python27/barley/0010141~0011953~ 如你所见,有近30个类似该格式的文件夹,在它们下面至少有 30 个 txt 文件。 有什么有效的方法来阅读它们吗?
【问题讨论】: