【发布时间】:2017-12-23 05:18:56
【问题描述】:
我是 Flink 新手,我的理解是遵循 API 调用
StreamExecutionEnvironment.getExecutionEnvironment().readFile(format, path)
将为给定的 S3 存储桶路径并行读取文件。
我们将日志文件存储在 S3 中。要求是服务多个客户端请求以从不同的文件夹中读取时间戳。
对于我的用例,为了服务多个客户端请求,我正在评估使用 Flink。所以我希望 Flink 对不同的 AWS S3 文件路径并行执行 AWS S3 读取。
是否有可能在单个 Flink Job 中实现这一点。有什么建议吗?
【问题讨论】:
标签: amazon-s3 apache-flink flink-streaming flink-cep