【发布时间】:2017-10-05 17:08:04
【问题描述】:
with open(files, "rb") as f:
reader = csv.reader(f, delimiter=",")
totalTweets = 0
for i, line in enumerate(reader):
totalTweets += 1
hashtagsArr = re.findall(r"#(\w+)", line[2])
for eachHashtag in hashtagsArr:
hashtagsArr.append(eachHashtag)
为什么 for 循环会为大型 csv 文件生成内存错误?我只是在迭代一个大的 csv 文件。
【问题讨论】:
-
您正在将新的主题标签附加到您正在迭代的同一主题标签列表中。对我来说,这听起来像是一个永无止境的循环:
for eachHashtag in hashtagsArr: hashtagsArr.append(eachHashtag)可能永远不会终止。
标签: python csv for-loop out-of-memory