【发布时间】:2017-07-05 10:26:11
【问题描述】:
我的数据包含包含日期时间信息的行程、每次行程的用户 ID 和行程类型(单次、圆形、伪)。
这是一个名为 All_Data 的数据样本(pandas 数据框):
HoraDTRetirada idpass type
2016-02-17 15:36:00 39579449489 'single'
2016-02-18 19:13:00 39579449489 'single'
2016-02-26 09:20:00 72986744521 'pseudo'
2016-02-27 12:11:00 72986744521 'round'
2016-02-27 14:55:00 11533148958 'pseudo'
2016-02-28 12:27:00 72986744521 'round'
2016-02-28 16:32:00 72986744521 'round'
我想按用户统计每个类别在“一年中的一周”中重复的次数。
例如,如果同一用户的事件发生在星期一,而下一个事件发生在星期四,则同一周会发生两个事件;但是,如果一个事件发生在星期六,而下一个事件发生在下一个星期一,它们发生在不同的星期。
我正在寻找的输出将是这样的形式:
idpass weekofyear type frequency
39579449489 1 'single' 2
72986744521 2 'round' 3
72986744521 2 'pseudo' 1
11533148958 2 'pseudo' 1
编辑:这个older question 解决了类似的问题,但我不知道如何使用 pandas 来解决。
【问题讨论】:
-
df 中的最后一个示例是 2 月 30 日。如果您使用标准库进行日期转换,这可能会给您带来错误。
-
谢谢,我修好了。我出于示例目的快速修改了它,并没有关注月份。
-
所有数据点都是同一年的吗?
标签: python python-3.x pandas anaconda