【问题标题】:AWS ElasticSearch Loading Streaming DataAWS ElasticSearch 加载流数据
【发布时间】:2017-01-21 21:21:25
【问题描述】:

我正在关注guide 将实时 Web 流量数据加载到 S3,配置 Lambda 以加载到 ES 域索引。目前,对于每条记录,我在 S3 存储桶中创建一个新的 json 文件,名为 {GUID}.json ,其中仅包含一行。例如:

{"email":"example@test.com","firstname":"Hello","lastname":"World"}

所以当它上线时,它将在 S3 存储桶中上传数百万个 json 文件,然后通过 Lambda 函数推送到 ES。这是加载流数据的正确方法吗?或者我应该开发一个预定的流程来每小时聚合多条记录,例如每个 json 文件 10k 条记录然后上传到 S3 存储桶?我觉得这不是技术上的“实时流媒体”。

有什么建议吗?

【问题讨论】:

    标签: json amazon-web-services amazon-s3 aws-lambda amazon-elasticsearch


    【解决方案1】:

    您是否尝试过使用 AWS Kinesis Firehose 将流数据加载到 ElasticSearch?

    参考:https://aws.amazon.com/kinesis/firehose/firehose-to-elasticsearch-service/

    这将消除您的大部分努力。

    【讨论】:

    猜你喜欢
    • 2021-09-01
    • 1970-01-01
    • 1970-01-01
    • 2021-08-27
    • 1970-01-01
    • 2016-12-10
    • 1970-01-01
    • 1970-01-01
    • 2021-07-24
    相关资源
    最近更新 更多