【发布时间】:2019-07-16 19:17:08
【问题描述】:
我正在将 json 文件导入 python3 jupyter notebook。 json文件格式为
- 对象
- 房间[26个元素]
- 0
- 转
- 来自浴室
- 从停车场
- 距离
- dfromBathroom
- dfromParking
- 深度
- 地区
- 转
- 1
- ....等
- 0
- 姓名
- 房间[26个元素]
我是这样导入json文件的:
import pandas as pd
import numpy as np
import json
from pandas.io.json import json_normalize
with open("rooms.json") as file:
data = json.load(file)
df = json_normalize(data['rooms'])
我现在尝试以类似矩阵的格式绘制 6 个维度中的每一个,总共 36 个图。
我正在尝试以下方式:
col_features = ['fromBathroom', 'fromParking', 'dfromBathroom', 'dfromParking', 'depth', 'area']
pd.plotting.scatter_matrix(df[col_features], alpha = .2, figsize = (14,8))
这不起作用,因为我收到一条错误消息: KeyError:“['fromBathroom' 'fromParking' 'dfromBathroom' 'dfromParking'] 不在索引中”
这是因为这些特征嵌套在 json 文件中的“转弯”和“距离”中。有没有办法取消嵌套这些特征,以便我可以像获取深度和面积一样索引到数据框以获取值?
感谢您提供任何见解。
【问题讨论】:
标签: python pandas dataframe jupyter-notebook dimensionality-reduction