【发布时间】:2020-04-26 22:52:14
【问题描述】:
我正在尝试使用多处理队列存储多个 API 请求的结果,因为 API 一次无法处理超过 5 个连接。
我找到了How to use multiprocessing with requests module?的部分解决方案
def worker(input_queue, stop_event):
while not stop_event.is_set():
try:
# Check if any request has arrived in the input queue. If not,
# loop back and try again.
request = input_queue.get(True, 1)
input_queue.task_done()
except queue.Empty:
continue
print('Started working on:', request)
api_request_function(request) #make request using a function I wrote
print('Stopped working on:', request)
def master(api_requests):
input_queue = multiprocessing.JoinableQueue()
stop_event = multiprocessing.Event()
workers = []
# Create workers.
for i in range(3):
p = multiprocessing.Process(target=worker,
args=(input_queue, stop_event))
workers.append(p)
p.start()
# Distribute work.
for requests in api_requests:
input_queue.put(requests)
# Wait for the queue to be consumed.
input_queue.join()
# Ask the workers to quit.
stop_event.set()
# Wait for workers to quit.
for w in workers:
w.join()
print('Done')
我查看了有关线程和池的文档,但缺少一个步骤。所以上面的运行并且所有的请求都会得到一个 200 状态码,这很棒。但是我是否存储了请求的结果以供使用?
感谢您的帮助 山
【问题讨论】: