【发布时间】:2021-12-16 08:31:35
【问题描述】:
我需要将 json 文件转换为数据框,但是该 json 文件的列中有嵌套数据。我能够使用 pd.json_normalize(data=df['column']) 成功转换具有一层嵌套的列
{'ts_tc': '2021-10-21T21:50:05.121Z', 'line_of_business': 'kiosk', 'consent_status': 'active'}
我的问题是我有另一列字典列表具有数组形式的双重嵌套数据,其中 epd 是另一个字典。
[{'uid': 'abcd', 'sid': '1234', 'sc': 'false', 'epd': '{"value1":"66.72","value2":"66.72123"}'}, {'uid': 'abcd', 'sid': '1234', 'epd': '{"value1":"69.72","value2":"69.72123"}'}]
当我使用 pd.json_normalize 时,我得到了 'list' object has no attribute 'values' 错误消息。我也尝试了 flatten_json 库,但它对我不起作用。 如何完全展平数据框,以便拥有:
| uid | sid | sc | value1 | value2 |
|---|---|---|---|---|
| abcd | 1234 | false | 66.72 | 66.72123 |
| abcd | 1234 | 69.72 | 69.72123 |
【问题讨论】:
-
epd 中的值不是另一个字典是字符串..