【发布时间】:2016-02-26 07:24:34
【问题描述】:
Spark 具有用于各种数据库和数据存储的连接器。
但是,为您自己的自定义分布式数据库创建连接器需要什么。 据我了解,Spark 使用 Hadoop 连接器从分布式数据存储中获取数据。我找不到很好的资源来了解 Hadoop 连接器的工作原理以及如何制作。
我希望了解 Hadoop 连接器的语义,以便能够为我的自定义数据库创建一个。
【问题讨论】:
标签: hadoop apache-spark distributed-computing