【发布时间】:2020-10-16 04:26:37
【问题描述】:
在我两周的 Azure 体验中。我想根据大小拆分文件。例如,有一个包含 200k 行的表,我想设置一个参数以将该表拆分为多个文件,每个文件的限制为 100Mb(如果有意义的话)。它将根据表大小返回N 文件数。类似:
my_file_1ofN.csv
我正在浏览文档、博客和视频,并且可以在我的个人帐户中使用 Python 脚本对 Azure Functions、Azure Batch 和 Databricks 进行一些 POC。问题是公司不允许我使用这些方法中的任何一种。
所以我使用分区数分割文件,但这些文件的大小因表和分区而异。
有没有办法做到这一点?我现在正在尝试lookups 和foreach 活动,但效果不佳。
欢迎任何想法或线索。谢谢!!
【问题讨论】:
标签: azure azure-data-factory-2 azure-data-factory-pipeline