【发布时间】:2020-07-06 21:57:19
【问题描述】:
我是 ML、pandas 和 numpy 的新手。
我正在浏览一个线性回归程序的 jupyter 文件。我在那里看到
dataset = pd.read_csv('C:\First ML Projects/winequality.csv').
当我执行type(dataset) 时,我得到了pandas.core.frame.DataFrame。有道理,因为数据集是使用 pd 的方法创建的
然后,就有了这段代码,
X = dataset[['fixed acidity', 'volatile acidity', 'citric acid', 'residual sugar', 'chlorides', 'free sulfur dioxide', 'total sulfur dioxide', 'density', 'pH', 'sulphates','alcohol']].values
当我使用type(X) 时,我得到了numpy.ndarray。
第一个问题:为什么X 不是pandas.DataFrame 格式?
第二:当没有提到numpy或np时,它是如何转换为numpy.ndarray的?
第三:pandas.DataFrame 和 numpy.ndarray 都存储数据有什么区别?
【问题讨论】:
-
如果
df是一个数据框,那么df.values是一个numpy 数组。
标签: python pandas numpy linear-regression