【发布时间】:2021-04-30 15:40:01
【问题描述】:
我有一个数据集,它按日期和 unique_session_code 显示每个访问面包店网页的用户的登录信息。我正在尝试编写一个代码,让我可以确定这是第一次,第二次,第三次等等......这个客户的访问,换句话说就是“nth_visit”,我真的在寻找使用 tidyverse 包的解决方案,但如果无法使用 tidyverse 做到这一点,那么所有其他解决方案都将受到赞赏。谢谢你们的帮助!
| USER | LOG_DATE | TX_REV |
|---|---|---|
| ALEX | 30/04/2021 | uyjd |
| MARY | 30/04/2021 | dn89 |
| DOLLY | 30/04/2021 | nqmd0 |
| FRANK | 29/04/2021 | nsj456 |
| MARY | 29/04/2021 | zlpa2 |
| DOLLY | 29/04/2021 | s09dm |
| ALEX | 28/04/2021 | jds02 |
| MARY | 28/04/2021 | kqos98 |
| DOLLY | 28/04/2021 | uiskk0 |
这将是我想要的结果:
| USER | LOG_DATE | TX_REV | nth_visit |
|---|---|---|---|
| ALEX | 28/04/2021 | jds02 | 1 |
| ALEX | 30/04/2021 | uyjd | 2 |
| DOLLY | 28/04/2021 | uiskk0 | 1 |
| DOLLY | 29/04/2021 | s09dm | 2 |
| DOLLY | 30/04/2021 | nqmd0 | 3 |
| FRANK | 29/04/2021 | nsj456 | 1 |
| MARY | 28/04/2021 | kqos98 | 1 |
| MARY | 29/04/2021 | zlpa2 | 2 |
| MARY | 30/04/2021 | dn89 | 3 |
访问者每次尝试访问网站的“nth_visit”数据框
我做了什么?
我尝试按时间顺序排列日期并按 ID 分组,并查看了一些文档,我尝试使用函数 rank_dense 但它没有给我我正在寻找的结果......甚至没有接近。
非常感谢你们
代码:
df<-tibble::tribble(
~USER, ~LOG_DATE, ~TX_REV,
"ALEX", "30/04/2021", "uyjd",
"MARY", "30/04/2021", "dn89",
"DOLLY", "30/04/2021", "nqmd0",
"FRANK", "29/04/2021", "nsj456",
"MARY", "29/04/2021", "zlpa2",
"DOLLY", "29/04/2021", "s09dm",
"ALEX", "28/04/2021", "jds02",
"MARY", "28/04/2021", "kqos98",
"DOLLY", "28/04/2021", "uiskk0")
【问题讨论】:
-
使用
row_number()
标签: r indexing count tidyverse summary