【发布时间】:2020-04-05 11:31:54
【问题描述】:
哪种序列化用于哪种情况,
从火花文档它说:
它提供了两个序列化库:
1. Java(默认)和
2. 克里奥
现在编码器从哪里来,为什么文档中没有给出。
并且从数据砖中它说编码器对数据集的执行速度更快,RDD 怎么样,以及所有这些映射如何结合在一起。
在什么情况下我们应该使用哪个序列化器?
【问题讨论】:
标签: scala apache-spark serialization encoder kryo
哪种序列化用于哪种情况,
从火花文档它说:
它提供了两个序列化库:
1. Java(默认)和
2. 克里奥
现在编码器从哪里来,为什么文档中没有给出。
并且从数据砖中它说编码器对数据集的执行速度更快,RDD 怎么样,以及所有这些映射如何结合在一起。
在什么情况下我们应该使用哪个序列化器?
【问题讨论】:
标签: scala apache-spark serialization encoder kryo
Encoders 仅用于 Dataset。 Kryo 在内部使用
火花。 Kryo 和 Java 序列化可供您使用
用于数据洗牌。至于您应该使用哪个 - 如果您不使用 Dataset,Kryo 是您的最佳选择。否则实际上你别无选择。
【讨论】: