【发布时间】:2014-11-04 03:54:42
【问题描述】:
我正在尝试使用 Numpy 代替 Matlab,但我对 Python 比较陌生。
我当前的挑战是以合理的方式将数据导入多个文件中,以便我可以使用和绘制它。数据按列组织(温度、压力、时间等,每个文件都是一个测量周期),我认为 pandas 可能是导入数据的最佳方式。我正在考虑为每个文件使用顶级描述符,并为每列使用子描述符。想过做这样的事情。 Reading Multiple CSV Files into Python Pandas Dataframe
问题是我想保留和使用标题中的一些数据(例如用于绘图)。没有列标题,而是有关数据测量的一般信息,如下所示:
Flight ID: XXXXXX
Date: 01-27-10 Time: 5:25:19
OWNER
Release Point: xx.304N xx.060E 11 m
Serial Number xxxxxx
Surface Data: 985.1 mb 1.0 C 100% 1.0 m/s @ 308 deg.
我真的不知道如何以与数据框组合时有意义的方式提取和存储数据。可能想到了一本字典,但我不确定如何有效地拆分数据,因为没有一致的分隔符。有什么想法吗?
【问题讨论】:
-
您是否要求解析标题并用作列名?有点不清楚你想要什么,你能解释一下吗
-
我并不感到惊讶,这是一个非常开放的问题,因为我对一个好的解决方案没有具体的想法。我不希望它作为标题,我已经有了。我不一定需要它作为数据框的一部分,我真的不知道如何以合理的方式组织它。我可以选择字典之类的东西,只要我可以在需要在绘图中使用它时访问信息或获取有关数据框中数据的更多详细信息,但我不确定如何提取信息.
-
您可以将其作为属性添加到 df 中:
df.flight_ID = 'XXXXXX'等。但是,如果复制 df,则属性将被 NOT 复制,因此您需要小心
标签: python numpy pandas dataframe