【发布时间】:2020-10-07 17:46:21
【问题描述】:
问题描述
我正在处理美国冲突事件的电子表格。每行代表一个事件,并包含地理和时间信息。冲突事件往往以“波”的形式发生(相对紧密的时间分组)。我已经为每一波生成了一个身份变量,并想创建一个变量来衡量这些冲突事件在每一波过程中的地理分布。
我wanted to do this in Excel,但不幸的是我没有可用的动态数组公式。在升级到新版本的 Excel 之前,我想看看在 R 中是否可以。数据已经按地区、日期和波次排序。
数据说明
数据集的结构如下:
Country Region Date Event Wave
------- ------- ------ ------- ------
USA Vermont 5/1/2017 Strike Wave 1
USA Vermont 5/2/2017 Strike Wave 1
USA New Hamp. 5/3/2017 Strike Wave 1
USA Vermont 5/3/2017 Strike Wave 1
USA Maine 5/4/2017 Strike Wave 1
USA Washingt. 8/16/2018 Riot Wave 2
USA Washingt. 8/18/2018 Riot Wave 2
USA Oregon 8/18/2018 Protest Wave 2
USA Californ. 8/19/2018 Riot Wave 2
USA Nevada 8/20/2018 Protest Wave 2
USA Idaho 8/20/2018 Riot Wave 2
我想创造什么
我想创建一个变量(“geo_disp”),用于记录在给定wave中发生冲突的区域的数量。在整个浪潮中,我预计区域的数量会增加,并且我希望 geo_disp 变量记录这一点。
您会注意到,当两个事件发生在同一天但发生在不同的位置时,两者都会被记录在区域总数中。
这是我希望数据的样子:
Country Region Date Event Wave geo_disp
------- ------- ------ ------- ------ --------
USA Vermont 5/1/2017 Strike Wave 1 1
USA Vermont 5/2/2017 Strike Wave 1 1
USA New Hamp. 5/3/2017 Strike Wave 1 2
USA Vermont 5/3/2017 Strike Wave 1 2
USA Maine 5/4/2017 Strike Wave 1 3
USA Washingt. 8/16/2018 Riot Wave 2 1
USA Washingt. 8/18/2018 Riot Wave 2 2
USA Oregon 8/18/2018 Protest Wave 2 2
USA Californ. 8/19/2018 Riot Wave 2 3
USA Nevada 8/20/2018 Protest Wave 2 5
USA Idaho 8/20/2018 Riot Wave 2 5
如何使用 R 创建 geo_disp 变量?
提前感谢您 - 非常感谢。
【问题讨论】:
标签: r criteria rolling-computation