【发布时间】:2016-06-16 00:10:13
【问题描述】:
我正在使用Spark 1.3.0 和Spark Avro 1.0.0。 我在the example on the repository page 工作。以下代码运行良好
val df = sqlContext.read.avro("src/test/resources/episodes.avro")
df.filter("doctor > 5").write.avro("/tmp/output")
但是如果我需要查看doctor 字符串是否包含子字符串怎么办?因为我们在字符串中编写表达式。我该怎么做才能做一个“包含”?
【问题讨论】:
标签: scala apache-spark dataframe apache-spark-sql