【发布时间】:2014-12-09 19:26:44
【问题描述】:
我有一个 .dat 文件,它有 n 行,一行中有多个字段。 每个字段由“|”分隔。现在我想写一个map reduce程序来计数 特定字段的行数(我可以在 hive 中使用 count(Column_name))。 我对映射减少编程非常陌生。任何帮助将不胜感激。
【问题讨论】:
标签: hadoop mapreduce apache-pig
我有一个 .dat 文件,它有 n 行,一行中有多个字段。 每个字段由“|”分隔。现在我想写一个map reduce程序来计数 特定字段的行数(我可以在 hive 中使用 count(Column_name))。 我对映射减少编程非常陌生。任何帮助将不胜感激。
【问题讨论】:
标签: hadoop mapreduce apache-pig
你应该先学习“字数”这个例子,然后你才能知道如何处理你的问题。
这是http://kickstarthadoop.blogspot.com/2011/04/word-count-hadoop-map-reduce-example.html的例子
【讨论】: