【发布时间】:2020-05-04 20:19:12
【问题描述】:
我有一个如下所示的数据集:
Federal.Area State Total_Miles
1 Allentown, PA--NJ NJ 1094508
2 Allentown, PA--NJ PA 9957805
3 Augusta-Richmond County, GA--SC GA 6221747
4 Augusta-Richmond County, GA--SC SC 2101823
5 Beloit, WI--IL IL 324238
6 Beloit, WI--IL WI 542491
我想按Federal.Area 折叠行,但创建并保留包含唯一State 和唯一Total_Miles 的新变量,使其看起来像这样:
Federal.Area State Total_Miles State1 State2 Total_Miles_state1 Total_Miles_state2
<fct> <fct> <dbl> <fct> <fct> <dbl> <dbl>
1 Allentown, PA--NJ NJ 1094508 NJ PA 1094508 9957805
2 Augusta-Richmond Cou… GA 6221747 GA SC 6221747 2101823
3 Beloit, WI--IL IL 324238 IL WI 324238 542491
我不知道如何将变量 State 和 Total_Miles 折叠到同一行,但作为新变量键入 Federal.Area。
【问题讨论】:
-
欢迎来到stackoverflow。代码格式化是用反引号按钮而不是单引号完成的。在大多数键盘上,反引号位于数字 1 旁边,与 ~ 位于同一键上。
-
在您的示例中,每个联邦地区似乎有两行。总是这样吗?如果不是,当一个联邦地区有三行或更多行时,您想要的输出是什么?
-
我很抱歉。这是我第一次真正使用该网站。我现在会尝试编辑。这实际上是一个很好的问题,在三个
State中有几个实例是一个Federal.Area。考虑到这一点,新的数据框应该真的有State3和Total_Miles_State3。最终目标是将每个唯一的 Federal.Area(无论是 2 还是 3)折叠成一行,并从各自的State分配相应的Total_Miles作为新变量。我将使用这些新变量来计算每个federal.area在每个州行驶的“Total_Miles”的百分比。 -
再次道歉。我正在学习如何提出好的问题。我应该说这样做的目的是让我可以
join这个 df 到另一个在Federal.Area上的键但是我不能加入它们,因为当前的 df 有多行federal.area而另一个 df 有只有一个