【发布时间】:2021-03-29 07:33:28
【问题描述】:
在文本分析上使用 logitics Reg 后,我试图将 X_test、y_arr_test(标签)和 y_predictions 组合到一个数据帧,但不知道该怎么做。需要帮助。
'''
from sklearn.feature_extraction.text import CountVectorizer
vectorizer = CountVectorizer()
vectorizer.fit(X_arr_train)
X_train = vectorizer.transform(X_arr_train)
X_test = vectorizer.transform(X_arr_test)
X_train
'''
'''
# logistic Reg
from sklearn.linear_model import LogisticRegression
classifier = LogisticRegression()
classifier.fit(X_train, y_arr_train)
score = classifier.score(X_test, y_arr_test)
y_predictions=classifier.predict(X_test)
'''
X_test
返回:' 类型的稀疏矩阵
以压缩稀疏行格式存储 26934 个元素>
np.shape(y_arr_test)
返回:(1333,)
然后我不知道如何将 X_test、y_arr_test(标签)和 y_predictions 放入 ONE 数据帧。目标是显示错误的预测并知道原因。 谢谢。
【问题讨论】:
标签: python pandas scikit-learn nlp concatenation