【发布时间】:2021-09-13 19:47:43
【问题描述】:
我有一个可以移动大约 1 TB 数据(所有 CSV 文件)的管道。在这个管道中有数百个不同名称的文件。它们有一个自动分区的日期组件。我的问题是如何使用 CDK 根据文件名自动创建子文件夹。换句话说,数据属于广泛的类别,但我们的数据科学家需要更详细的数据。
【问题讨论】:
-
这听起来不像是 AWS CDK 可以做的事情。它应该由“管道”完成,或者作为管道之后的一个过程(例如 S3 触发“移动”对象的 AWS Lambda 函数)。
-
好的,关于如何在 Python 中编写脚本有什么建议吗?
标签: amazon-web-services amazon-s3 aws-cli aws-cdk