【发布时间】:2018-06-24 00:52:17
【问题描述】:
file.txt 有一个标题和四列。但是标题一直在变化。
类似:
,'non_standard_header_1','non_standard_header_2','non_standard_header_3'
,kdfjlkjdf, sdfdfd,,
,kdfjlkjwwdf, sdfddffd,,
,kdfjlkjwwdf,, sdfddffd,
我想在 pandas 中导入 file.txt,并且我希望将列作为 object 导入。直观的方法(对我来说):
dtype = [object, object, object] 如:
daily_file = pandas.read_csv('file.txt',
usecols = [1, 2, 3],
dtype = [object, object, object])
不起作用,运行上面,我得到:
data type not understood
如何在导入时设置列 dtype 而不引用(现有)列名?
【问题讨论】:
-
通过实验,我找到了一种方法来处理这个问题。给定一个带有单个未标记列的 CSV(第一个,由
pandas.to_csv创建,没有为索引指定标签),Pandas 为该列分配了名称“Unnamed: 0”;我能够使用相同的字符串作为dtype的字典键,并正确控制列的数据类型。不确定这是多么普遍,所以把它和一个适当的“答案”留给其他人。