【问题标题】:Hadoop Mapper to read key-value pairsHadoop Mapper 读取键值对
【发布时间】:2014-09-09 03:41:31
【问题描述】:

是否有可以在映射器函数中使用的内置 InputFormat 来读取以下格式的输入行:

Name [key1#val1,key2#val2,key3#val3,key4#val4]

示例输入数据可能如下所示:

sanjose [population#123,area#123,address#1,jkui,ty,tz#PST]
delhi [population#1823,area#1023,address#1,jkui,ty,tz#IST]
boston [population#1823,area#1023,address#1,jkui,ty,tz#EST]

【问题讨论】:

  • 减速机在您的情况下应该如何工作?与您的格式不同,reducer 只能处理键值对

标签: hadoop mapreduce


【解决方案1】:

设置属性mapreduce.input.keyvaluelinerecordreader.key.value.separator并使用job.setInputFormatClass(KeyValueTextInputFormat.class);

在您的情况下,我相信 \t 是键值分隔符

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-10-22
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多