【发布时间】:2011-11-29 09:40:24
【问题描述】:
我有一些关于 hadoop 顺序文件的基本问题。
1) 默认压缩编解码器将文件压缩到什么程度?
2) 当我读取此文件并将其内容转储到文本文件时,我有 100 MB 的 hadoop 序列文件,我观察到的文本文件大小约为 1GB(可以吗?)
3)读取序列文件时"syncSeen()"的意义是什么? “寻求(多头头寸)” ?如果我在阅读时不使用这些调用有什么问题吗? 关于如何使用这些方法的任何示例?
【问题讨论】:
标签: filesystems compression hadoop sequence hdfs