【发布时间】:2018-08-03 04:56:40
【问题描述】:
使用 AWS Glue 在 S3 中使用 snappy 压缩保存 Avro 文件(gzip/bzip2 压缩也同样的错误)后,当我尝试使用 AWS Crawler 读取 athena 中的数据时,我收到以下错误 - HIVE_CANNOT_OPEN_SPLIT: Error opening Hive拆分 - 使用 org.apache.hadoop.hive.ql.io.avro.AvroContainerInputFormat:不是数据文件。知道为什么会出现此错误以及如何解决此问题吗?
【问题讨论】:
-
考虑为您的问题添加更多信息。
标签: amazon-web-services hadoop pyspark aws-glue