【问题标题】:Trouble grouping by date when counting rows in R在 R 中计算行数时无法按日期分组
【发布时间】:2019-02-16 18:54:35
【问题描述】:

我正在使用唐纳德特朗普推文的公共数据集,可在此处找到: https://www.kaggle.com/kingburrito666/better-donald-trump-tweets

这样做之后,我尝试在 R 中按日期对其进行分组。首先,我想计算推文的数量。第二天,我想总结一下“收藏夹”和“转推”公关。天。

我写了下面的代码,但是它总是给我错误...你能帮帮我吗?

提前致谢!

 Donald <- read_csv(file="Donald-Tweets!.csv")
Donald
#Grouped
G_filter <- Donald %>%
  select(Date,twt_favourites_IS_THIS_LIKE_QUESTION_MARK, Retweets) %>% 
  rename( Favourites = twt_favourites_IS_THIS_LIKE_QUESTION_MARK) %>% 
  group_by(as.Date.date(Date)) %>% 
summarise(Total = sum(Favourites+Retweets), count(n))


View(G_filter)

【问题讨论】:

  • 什么是as.Date.date
  • 另外,一些示例数据可能会有所帮助,这将让我们看看对 as.Date() 的调用是否有意义。
  • "...但它总是给我错误..."您应该明确说明错误消息。错误消息通常会提供建设性的反馈。

标签: r date dataframe dplyr grouping


【解决方案1】:

这可能就是你要找的东西。

library(tidyverse)

G_filter <- Donald %>%
  select(Date, twt_favourites_IS_THIS_LIKE_QUESTION_MARK, Retweets) %>% 
  rename(Favourites = twt_favourites_IS_THIS_LIKE_QUESTION_MARK) %>% 
  group_by(Date) %>%
  mutate(Favorites_and_Retweets = Favourites + Retweets) %>%
  summarise(Favorites_and_Retweets = sum(Favorites_and_Retweets),
            Count = n())
G_filter
# # A tibble: 479 x 3
#    Date     Favorites_and_Retweets Count
#    <chr>                     <int> <int>
#  1 15-07-16                  66899    39
#  2 15-07-17                  65212    22
#  3 15-07-18                  97381    32
#  4 15-07-19                  34229    12
#  5 15-07-20                  62316    37
#  6 15-07-21                  88132    62
#  7 15-07-22                  69919    37
#  8 15-07-23                  67963    43
#  9 15-07-24                  67687    35
# 10 15-07-25                  39744    25
# # ... with 469 more rows

无需转换Date 列。如果你真的想这样做,一种方法是加载lubridate 包,然后在管道中执行mutate(Date = ymd(Date))

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2021-05-18
    • 2021-11-10
    • 1970-01-01
    • 1970-01-01
    • 2017-03-26
    • 2015-01-17
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多