【发布时间】:2017-10-14 13:09:42
【问题描述】:
我想从 hdfs 获取文件并保存到 cassandra
import org.apache.spark.{SparkConf, SparkContext}
import com.datastax.spark.connector._
val conf = new SparkConf().setMaster("local[2]).setAppName("test")
.set("spark.cassandra.connection.host", "192.168.0.1")
val sc = new SparkContext(conf)
val files = sc.textFiles("hdfs://192.168.0.1:9000/test/", 1)
files.map(_.split("\n")).saveToCassandra("ks", "tb", SomeColumns("id", "time", "text"))
sc.stop()
但由于异常,我无法将其写入 cassandra
我得到的文件,因为 files.foreach(x => println(x)) 有效
【问题讨论】:
-
错误是什么?
-
线程“main”java.lang.IllegalArgumentException 中的异常:要求失败:在 scala.Array[String] 中找不到列:[id, time, text]
标签: scala apache-spark hdfs spark-streaming spark-cassandra-connector