【发布时间】:2021-07-14 16:48:53
【问题描述】:
我有一个 2gb 的 csv 文件,它是使用 pandas 创建的。这是数据框在下载为 .csv 文件之前的样子:
id, x, y
1, 2, 3
1, 2, 3
2, 1, 2
x 和 y 是使用合并函数创建的(我将它合并到 id 列上)。 这是我将其下载为 csv(使用 to_csv 函数)并将其解析为 df(使用 read_csv 函数)后的样子:
id, x, y
1, NaN, NaN
1, 2, 3
2, 1, 2
我该如何解决这个问题?
【问题讨论】:
-
df.groupby('id').bfill()?不知道为什么它会在下载后删除您的数据,也许您的 csv 已损坏? -
合并函数的代码与您的数据看起来如何?一个原因应该是混合
1像string-'1'和数字,1- 所以如果使用左连接'1'不应该合并(我只是猜测,这是与数据相关的问题)