【发布时间】:2020-06-21 18:58:52
【问题描述】:
我正在尝试对类似的样本数据进行标准化
{
"2018-04-26 10:09:33": [
{
"user_id": "M8BE957ZA",
"ts": "2018-04-26 10:06:33",
"message": "Hello"
}
],
"2018-04-27 19:10:55": [
{
"user_id": "M5320QS1X",
"ts": "2018-04-27 19:10:55",
"message": "Thank you"
}
],
我知道我可以使用json_normalize(data,'2018-04-26 10:09:33',record_prefix= '') 在 pandas 中创建一个表,但日期/时间一直在变化。我怎样才能标准化它,所以我有如下?任何建议
user_id. ts message
2018-04-26 10:09:33 M8BE957ZA. 2018-04-26 10:06:33. Hello
2018-04-26 10:09:33 M5320QS1X 2018-04-27 19:10:55. Thank you
【问题讨论】:
-
既然字典的键在字典中重复,为什么不从
your_dict.values()创建你的数据框?你的输出指数对吗?第二行索引从何而来? -
获得值后,如何访问 user_id、ts 和消息?创建数据框
标签: python json pandas normalize