【问题标题】:How do I make a new data frame with variables in two columns matching each other, using DPLYR?如何使用 DPLYR 创建一个新的数据框,其中两列中的变量相互匹配?
【发布时间】:2017-10-27 08:57:13
【问题描述】:

这是我第一次在这里发布问题。如果我要问的任何内容含糊不清/我忘了添加额外的上下文信息,请随时告诉我,谢谢。

我的问题: 我刚刚制作了一个包含多列的数据框。如何为匹配具有相同变量的两行的新数据框编码,并排除我想要的变量不匹配的所有行? (以及我想要从上一个屏幕截图中获得的任何其他列)?

我当前数据框的屏幕截图: ONE , TWO (这不是整个数据框,因为列表很大,只是其中的一部分。)请注意每个州如何在其下有多个“县”。

THIS IS AN EXAMPLE OF WHAT I WANT MY FINAL DATA FRAME TO LOOK LIKE. 在我的新数据框中,我想排除位置名称与州名称不匹配的所有行(因此我将删除所有县和任何不是州名称的行)。

例如我想为一个新的数据框编码,我将加利福尼亚 = 加利福尼亚,同时也排除没有匹配变量的行,例如加利福尼亚 = 圣胡安县

我想使用 DPLYR 对所有这些进行编码。

谢谢!

【问题讨论】:

  • 请使用dput显示示例而不是图像

标签: r dataframe dplyr frame


【解决方案1】:

如果我能很好地理解你有点模糊的问题:

library(dplyr)

df%>%filter(column1==column2)

【讨论】:

    【解决方案2】:

    假设您的数字数据中没有 NA,如果是这样,请在执行以下代码之前将它们设置为 0

    library(dplyr)
    
    new_df = df %>% filter(any_drinking.state == any_drinking.location) %>% 
      mutate(both_sexes_2012 = any_drinking.females_2012+any_drinking.males_2012, 
             diff = any_drinking.males_2012-any_drinking.females_2012) %>% 
      rename(females_2012 = any_drinking.females_2012,males_2012 = any_drinking.males_2012, 
             state = any_drinking.state, location = any_drinking.location)
    

    【讨论】:

      猜你喜欢
      • 2021-10-10
      • 2023-04-07
      • 1970-01-01
      • 2022-12-06
      • 1970-01-01
      • 2020-04-11
      • 2020-01-31
      • 1970-01-01
      • 2018-06-25
      相关资源
      最近更新 更多