【发布时间】:2017-10-15 10:52:35
【问题描述】:
我有一个包含 21 列的 CSV 文件数据集,前 10 列是数字,我不想更改它们。接下来的 10 列是二进制数据,其中只包含 1 和 0,一个“1”,其他为“0”,最后一列是给定的标签。
示例数据如下所示
2596,51,3,258,0,510,221,232,148,6279,24(10th column),0,0,0,0,0,1(16th column),0,0,0,0,2(the last column)
假设我将数据加载到一个矩阵中,我可以保持前10列和最后一列不变,将中间10列转换为一列吗?转换后,我希望列值基于行中“1”的索引,就像上面的行一样,想要的结果是
2596,51,3,258,0,510,221,232,148,6279,24,6(it's 6 because the "1" is on 6th column of the binary data),2 #12 columns in total
我可以使用 NumPy、scikit-learn 或其他东西来实现这一点吗?
【问题讨论】:
标签: python pandas numpy scikit-learn