【发布时间】:2022-01-03 00:09:03
【问题描述】:
我有这个数据框
date,AA
1980-01-01, 77.7
1980-01-02, 86
1980-01-03, 92.3
1980-01-04, 96.4
1980-01-05, 85.7
1980-01-06, 75.7
1980-01-07, 86.8
1980-01-08, 93.2
1985-08-13, 224.6
1985-08-14, 213.9
1985-08-15, 205.7
1985-08-16, 207.3
1985-08-17, 202.1
我想计算每年的最大值和发生日期。我正在苦苦挣扎,因为我确实想将日期保留为索引。
我确实是这样读的:
dfr = pd.read_csv(fnamed, sep=',', header = 0, index_col=0, parse_dates=True)
我知道我可以重新采样为
dfr_D = dfr.resample('Y').max()
但在这种情况下,我会丢失有关年内最大值位置的信息。
我找到了这个:
idx = dfr.groupby(lambda x: dfr['date'][x].year)["A"].idxmax()
但是,dfr['date'] 似乎是列的名称,而在我的情况下,索引中的日期和 '.year' 不是它的属性之一。
我觉得我应该使用“groupby”和“indexmax”。但是,我参加的所有活动都失败了。
提前致谢
【问题讨论】:
标签: python pandas dataframe datetime indexing