【问题标题】:How to combine X_test, y test, and y predictions after text analytics prediction?文本分析预测后如何结合 X_test、y 测试和 y 预测?
【发布时间】:2021-03-29 07:33:28
【问题描述】:

在文本分析上使用 logitics Reg 后,我试图将 X_test、y_arr_test(标签)和 y_predictions 组合到一个数据帧,但不知道该怎么做。需要帮助。

'''

from sklearn.feature_extraction.text import CountVectorizer 
vectorizer = CountVectorizer()
vectorizer.fit(X_arr_train)
X_train = vectorizer.transform(X_arr_train)
X_test  = vectorizer.transform(X_arr_test)
X_train 

'''

'''

# logistic Reg
from sklearn.linear_model import LogisticRegression
classifier = LogisticRegression()
classifier.fit(X_train, y_arr_train)
score = classifier.score(X_test, y_arr_test) 
y_predictions=classifier.predict(X_test)

'''

X_test 返回:' 类型的稀疏矩阵 以压缩稀疏行格式存储 26934 个元素>

np.shape(y_arr_test) 返回:(1333,)

然后我不知道如何将 X_test、y_arr_test(标签)和 y_predictions 放入 ONE 数据帧。目标是显示错误的预测并知道原因。 谢谢。

【问题讨论】:

    标签: python pandas scikit-learn nlp concatenation


    【解决方案1】:

    如果我理解正确,您正在尝试并排合并两个或三个 DF。 你可以这样做:

    combined_df = pd.concat([df1, df2, df3], axis=1)
    

    与您的 DF:

    combined_df = pd.concat([X_test, y_arr_test,y_predictions], axis=1) 
    

    【讨论】:

    • 它给了我一个错误:“TypeError: cannot concatenate object of type ''; 只有 Series 和 DataFrame objs 是有效的”。感谢您的回复。
    猜你喜欢
    • 2019-04-02
    • 1970-01-01
    • 2016-10-29
    • 2017-06-27
    • 2018-09-11
    • 2018-09-02
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多