【发布时间】:2015-05-29 10:54:19
【问题描述】:
作为awk 的初学者,我可以将具有唯一值的数据拆分为
awk -F, '{print >> $1".csv";close($1)}' myfile.csv
但我想根据附加条件拆分一个大型 CSV 文件,即特定列中唯一值的出现。
具体来说,有输入
111,1,0,1
111,1,1,1
222,1,1,1
333,1,0,0
333,1,1,1
444,1,1,1
444,0,0,0
555,1,1,1
666,1,0,0
我希望输出文件是
111,1,0,1
111,1,1,1
222,1,1,1
333,1,0,0
333,1,1,1
和
444,1,1,1
444,1,0,1
555,1,1,1
666,1,0,0
每个都包含三个(在这种情况下)唯一值,111,222,333和444,555,666,分别位于第一列。
任何帮助将不胜感激。
【问题讨论】:
-
分割文件的条件是什么不清楚。
-
你的意思是每个文件有 3 个 uniq 值吗?
-
是的,我刚刚编辑了帖子。
标签: csv awk split conditional-statements find-occurrences