【发布时间】:2020-04-14 02:18:20
【问题描述】:
我有一个 pandas DataFrame,其中一列是由浮点数组成的。当我使用arr = df['col_name'].to_numpy() 时,我最终得到一个元组的一维数组,但我需要一个浮点数的二维数组。
到目前为止,我的解决方案是使用arr = np.array(df['col_name'].to_list())。这可行,但是先转换为列表然后再转换为数组似乎效率低下。所以我想知道,有没有更好的方法来做到这一点?
This question 是相关的,但唯一的答案指向以不同的方式读取文本文件,这对我来说不是一个选项,因为数据已经在 DataFrame 中。
【问题讨论】:
-
是dtype对象吗?
tolist步骤可能很快。另一种可能是vstack -
是的,
df['col_name'].dtype和arr.dtype都返回 dtype('O')。所以我应该坚持目前的做法? -
一个对象数组使用引用/指针,就像 python 列表一样。熊猫对象 dtype 系列也是。所以
to_list应该很快。
标签: python pandas numpy tuples numpy-ndarray