【发布时间】:2011-09-23 22:07:19
【问题描述】:
我需要解析一个大型日志文件(平面文件),其中包含两列值(A 列、B 列)。
两列中的值都是重复的。我需要找到 column-A 中的每个唯一值,我需要找到一组 column-B 值。
这可以使用 unix shell 命令完成还是需要编写任何 perl 或 python 脚本?有哪些方法可以做到这一点?
示例:
xxxA 2
xxxA 1
xxxB 2
XXXC 3
XXXA 3
xxxD 4
输出:
xxxA - 2,1,3
xxxB - 2
xxxC - 3
xxxD - 4
【问题讨论】:
-
我尝试使用 shell 命令 - 'cut' 、 'sort' 、 'uniq' 获取 column-A 的唯一值列表