【发布时间】:2020-02-26 01:08:40
【问题描述】:
我有一个包含很多日期的数据集。我想删除所有可用年份(2015、2016、2017 和 2018)的 1 月 1 日至 2 月 2 日的时间间隔内不存在的所有日期
new_data <- my_data %>%
filter(data > "2015-01-01" & data <"2015-02-02" &
data > "2016-01-01" & data <"2016-02-02" &
data > "2017-01-01" & data <"2017-02-02" &
data > "2018-01-01" & data <"2018-02-02")
我尝试了这个命令,但没有得到想要的结果:
sdf_nrow(new_data)
0
我正在使用 spark,这就是为什么我必须使用 dplyr
【问题讨论】:
标签: r apache-spark datetime dplyr