【发布时间】:2021-12-29 06:33:55
【问题描述】:
我有一个包含 10,000 行的 csv 文件,每行包含一个链接,我想下载每个链接的一些信息。由于这是一项消耗性的任务,我手动将其拆分为 4 个 Python 脚本,每个脚本处理 2,500 行。之后我打开 4 个终端并运行每个脚本。
但是我想知道是否有更有效的方法来做到这一点。到目前为止,我有 4 个脚本 .py 手动午餐。如果我必须做同样的事情但有 1,000,000 行会发生什么?我是否应该手动创建例如 50 个脚本并在每个脚本中下载该脚本行的信息?我希望我设法解释自己:)
谢谢!
【问题讨论】:
-
查看
multiprocessing.Pool()。