【发布时间】:2017-11-07 22:54:39
【问题描述】:
这是对以下问题的后续问题给here
我有以下数据
数据:
df = structure(list(Org_ID = c(1L, 1L, 1L, 2L, 2L, 3L, 3L, 3L, 3L),
Market_volume = c(100L, 200L, 300L, 50L, 500L, 400L, 200L,
300L, 100L), Indicator_variable = c(1L, 0L, 0L, 1L, 1L, 0L,
0L, 0L, 0L),variable3=c(10L, 1L, 1L, 4L, 2L, 3L, 3L, 10L, 3L),variable4=c(2L, 1L, 1L, 7L, 2L, 3L, 3L, 8L, 3L)).Names = c("Org_ID", "Market_volume", "Indicator_variable","Var3","Var4"
), class = "data.frame", row.names = c(NA, -9L))
使用 (dplyr),我通过以下函数按 Org_ID 计算了 NA 按市场交易量计算的百分比
df %>%
group_by(Org_ID) %>%
summarize(sum_market_vol = sum(Market_volume*!Indicator_variable),
tot_market_vol = sum(Market_volume)) %>%
transmute(Org_ID, Perc_Market_Vol = 100*sum_market_vol/tot_market_vol)
结果:
# A tibble: 3 x 2
Org_ID Perc_Market_Vol
<int> <dbl>
1 1 83.33333
2 2 0.00000
3 3 100.00000
问题: 我想通过删除 Org_ID 的所有行(比如 2)# X if perc_market_vol
我希望新数据如下所示:
df1 = structure(list(Org_ID = c(1L, 1L, 1L, 3L, 3L, 3L, 3L),
Market_volume = c(100L, 200L, 300L, 400L, 200L,
300L, 100L), Indicator_variable = c(1L, 0L, 0L, 0L,
0L, 0L, 0L),variable3=c(10L, 1L, 1L, 3L, 3L, 10L, 3L),variable4=c(2L, 1L, 1L, 3L, 3L, 8L, 3L)).Names = c("Org_ID", "Market_volume", "Indicator_variable","Var3","Var4"
), class = "data.frame", row.names = c(NA, -7L))
【问题讨论】:
-
“使用 (dplyr),我通过以下函数按 Org_ID 计算了按市场交易量计算的 NA 百分比” 您可能需要引用,因为代码是复制的直接来自here
-
UserR,我不知道可以引用。感谢 1. 帮助我回答上述问题,以及 2. 向我展示了如何引用。你的代码真的帮助了我!谢谢!
-
通过引用,我的意思是链接到原始答案,并提到这是另一个问题的后续问题。请在您的问题正文中执行此操作,而不是将其作为评论发布。