【发布时间】:2021-08-10 02:21:40
【问题描述】:
我已阅读有关如何创建假数据的文章,但我不明白如何从现有数据中创建假数据。
有人可以指导我如何做到这一点
【问题讨论】:
我已阅读有关如何创建假数据的文章,但我不明白如何从现有数据中创建假数据。
有人可以指导我如何做到这一点
【问题讨论】:
我建议您制作一个包含UG/PG 可以拥有的“正确”/“可能”值的字典,例如:
rolesdictug = {
'account manager': [list of ug valeus],
}
rolesdictpg = {
'account manager': [list of pg values]
}
并以相同的方式为其他角色添加其他键。 然后,使用:
import numpy as np
fakedf = pd.DataFrame(columns = df.columns)
fakedf['Current Role'] = np.random.choice( [list of all roles], size= required_size )
fakedf['UG'] = fakedf['Current Role'].apply( lambda x: np.random.choice(rolesdictug[x]) )
fakedf['PG'] = fakedf['Current Role'].apply( lambda x: np.random.choice(rolesdictpg[x]) )
这应该可行!
注意:两个字典的key必须和所有角色一样
【讨论】: