【发布时间】:2013-04-22 08:58:25
【问题描述】:
这似乎很简单,但经过将近一整天的时间,我还没有找到解决方案。我已经用 read_csv 加载了我的数据框,并且很容易将日期和时间列解析、组合和索引到一列中,但现在我希望能够根据小时和分钟分组来重塑和执行计算,类似于你可以在excel支点。
我知道如何重新采样到小时或分钟,但它维护与每个小时/分钟相关的日期部分,而我只想将数据集聚合到小时和分钟,类似于在 excel 数据透视表中分组并选择“小时”和“分钟”,但不选择其他任何内容。
任何帮助将不胜感激。
【问题讨论】:
-
从您拥有的每个
datetime对象中获取time对象是否有帮助?您可以从dataframe.index创建一个pandas.Series对象,然后将其分配给索引(替换当前索引)。你能“打印”你的数据框的一些行吗? -
谢谢。如果这就是您的意思,我不熟悉使用时间对象从日期时间列中获取时间。我刚刚找到了一种非常接近我需要的方法,分别使用以下代码每小时和每分钟,但是有没有更简单的方法可以做到这一点,尤其是每小时和每分钟在一起的方法?: hourly = ims_havas.groupby( ims_havas.index.hour).sum()