【问题标题】:Problems about Consistency model in google file systemgoogle文件系统中的一致性模型问题
【发布时间】:2012-12-23 04:01:18
【问题描述】:

看完The Google File System的文章,我还是有些疑惑:

  1. 'append operation'与'write operation'有什么优势?文章强调使用append操作而不是write操作,不知道为什么。Append比write快?

  2. 为了保持一个chunk的冗余之间的一致性,gfs使用lease让一个chunkserver作为primary,让primary决定操作顺序来达到一致性,我的问题是如果重试之后,更新操作仍然可以'不成功,冗余将处于不一致的状态。那么当不同的客户端来读取相同的块在相同的偏移量更新失败时,他们可能会读取不同的内容。gfs是如何处理这种问题的。

  3. 如果追加操作发生错误,主chunkserver会选择一个新的偏移量来追加记录吗?记录是什么意思?客户端读取文件时,如何处理文件中的一些填充或重复记录?

【问题讨论】:

  • 请更正文章的链接。你的意思是this paper

标签: distributed-system gfs


【解决方案1】:

论文中直接解决了您的所有问题,因此您应该再仔细阅读一遍。但是我会针对问题的每个部分给出简短的答案,以便给你一个条目:

  1. 这可以在启用并发写入的同时保持一致性。如果修改现有数据,对现有数据的并发写入会破坏一致性。如果你只做追加,你可以随意重新排序它们,保持 GFS 定义的一致性模型。

  2. 作为一致性模型的一部分,它不处理这个问题。客户必须处理它。

  3. 我不明白这部分问题。

问候,克里斯蒂安

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2014-10-20
    • 1970-01-01
    • 2013-08-22
    • 2015-05-08
    • 1970-01-01
    • 2021-04-03
    相关资源
    最近更新 更多