【发布时间】:2014-06-30 07:17:37
【问题描述】:
我的数据框需要有一个 DateTimeIndex。问题是我的源文件。 Date 标头是 Date(dd-mm-yy),但实际日期数据的格式为 dd:mm:yy (24:06:1970) 等。我有很多源文件,因此手动更改标头会很繁琐,而且不好的编程习惯。如何从 python 中解决这个问题?
也许创建一个源文件的副本打开它,搜索日期标题,更改它然后关闭它?我是 python 新手,所以我不确定这是否是做事的最佳方式,如果是,我该如何实现这样的代码?
目前我有这个;
df = pd.read_csv('test.csv',
skiprows = 4,
parse_dates = {'stamp':[0,1]},
na_values = 'NaN',
index_col = 'stamp'
)
其中第 0 列是相关日期列,第 1 列是时间列。 我没有收到任何错误消息,只是错误的数据。
抱歉,我应该添加相关 csv 文件的 sn-p。我现在在下面提供了它;
some stuff I dont want
some stuff I dont want
some stuff I dont want
some stuff I dont want
Date(dd-mm-yy),Time(hh:mm:ss),Julian_Day
01:07:2013,05:40:41,182.236586,659,1638.400000
01:07:2013,05:44:03,182.238924,659,1638.400000
01:07:2013,05:47:48,182.241528,659,1638.400000
01:07:2013,05:52:21,182.244687,659,1638.400000
【问题讨论】:
-
您能否提供一个示例,其中包含要读取的 csv 数据以及您收到的错误消息?
-
fyi,pandas 并不关心源文件的标题中关于日期格式的内容。