【发布时间】:2010-10-07 00:51:10
【问题描述】:
我在 S3 中存储了需要分析的大型数据文件。每批由约 50 个文件组成,每个文件都可以独立分析。
我想设置将 S3 数据并行下载到 EC2 实例中,并设置触发器以启动每个下载文件的分析过程。
是否有任何库可以处理异步下载、触发完整模型?
如果没有,我正在考虑使用 pyprocessing 设置多个下载进程,每个下载进程都会下载并分析单个文件。这听起来合理还是有更好的选择?
【问题讨论】:
标签: python amazon-s3 amazon-ec2