【发布时间】:2017-02-08 22:52:21
【问题描述】:
我的 pandas 数据框中有两列。
我想用Loan_Status 列(dtype : int64)的值填充Credit_History 列(dtype : int64)的缺失值。
【问题讨论】:
标签: python-2.7 pandas dataframe multiple-columns nan
我的 pandas 数据框中有两列。
我想用Loan_Status 列(dtype : int64)的值填充Credit_History 列(dtype : int64)的缺失值。
【问题讨论】:
标签: python-2.7 pandas dataframe multiple-columns nan
你可以试试fillna或combine_first:
df.Credit_History = df.Credit_History.fillna(df.Loan_Status)
或者:
df.Credit_History = df.Credit_History.combine_first(df.Loan_Status)
示例:
import pandas as pd
import numpy as np
df = pd.DataFrame({'Credit_History':[1,2,np.nan, np.nan],
'Loan_Status':[4,5,6,8]})
print (df)
Credit_History Loan_Status
0 1.0 4
1 2.0 5
2 NaN 6
3 NaN 8
df.Credit_History = df.Credit_History.combine_first(df.Loan_Status)
print (df)
Credit_History Loan_Status
0 1.0 4
1 2.0 5
2 6.0 6
3 8.0 8
【讨论】:
Credit_History 执行combine_first 操作后,Loan_Status 列是否出现在新数据框中?