【发布时间】:2012-01-15 08:58:43
【问题描述】:
我有一个数据框 df 有 2 个变量 A 和 B。我想将 A 拆分为第 1 组和第 2 组,以便 mean(df$B[df$group==1]) 尽可能接近 mean(df$B[df$group==2])
或者只是为了表达它,我想在df$A中找到一个切点(cutp),以最小化abs(mean(df$B[df$A<cutp])-mean(df$B[df$A>=cutp]))
有什么想法吗?
【问题讨论】:
-
第 1 组和第 2 组是否必须相等?
-
感谢您的评论。第 1 组和第 2 组的病例数应该大致相同(或至少没有大的差异)。
-
变量 A 在问题中是否起任何作用?
-
我不明白你的评论文森特。
-
您的 data.frame 包含两列,A 和 B,并且您写要“拆分 A”(而不是“拆分 df”)为两组,这表明应该使用列 A在分裂中——然而,它并没有明确地出现在你的条件中。
标签: r