【发布时间】:2016-04-02 14:12:15
【问题描述】:
我从geonames 下载了一个国家数据集,并且 我使用这一行将数据集解析为列:
data = pd.read_csv("C:/Users/Documents/TR.txt", sep="\t", header = None)
但由于某种原因,这并不能正确解析所有行。大多数行都被正确解析,大约 2K 没有。我使用这一行能够看到它没有正确解析:
data.to_csv("C:/Users/Documents/output.csv")
然后我在 excel 中打开了 output.csv,发现有些行没有被解析。 但是当我在 excel 上打开原始 TR.txt 数据集并使用制表符分隔符时,所有行都正确显示为已解析。所以我在我的python代码中做错了,但我不知道是什么。 我输出数据集错误吗? 谢谢
【问题讨论】:
-
在 Excel 中以制表符分隔打开 TR.txt 显示至少 7 行未正确解析,第一行是第 15191 行,第一列中的值为 311071 - 你也得到这个吗?
-
您的
RAM的大小是多少?
标签: python-3.x pandas import export geonames