【发布时间】:2022-01-19 17:14:05
【问题描述】:
这是我的数据:
df:
id sub_id
A 1
A 2
B 3
B 4
我有以下数组:
[[1,2],
[2,5],
[1,4],
[7,8]]
这是我的代码:
from collections import defaultdict
sub_id_array_dict = defaultdict(dict)
for i, s, a in zip(df['id'].to_list(), df['sub_id'].to_list(), arrays):
sub_id_array_dict[i][s] = a
现在,我的实际数据框总共包含 1 亿行(唯一 sub_id)和 50 万个唯一 ID。理想情况下,我想避免 for 循环。
任何帮助将不胜感激。
【问题讨论】:
标签: python pandas dictionary