我在读有关Spark optimization的书,但不清楚是如何做到的 钨 和 系列化 就像Kryo一起工作。
我读到的一些资料中的笔记让我想到了这个问题:
“与使用Java甚至Kryo序列化程序序列化的对象相比,Wonder的表示要小得多。” source-hortonworks
“通过代码生成,我们可以提高序列化的吞吐量,进而提高随机网络的吞吐量。” source-databricks
不包括一些边境案件,比如 Encoders.kryo .
Encoders.kryo
钨使用自己的二进制存储格式和相应的serde工具( Encoders ).这就是为什么在标准操作模式下它可以更快、更高效地存储。
Encoders