【发布时间】:2018-08-14 22:20:21
【问题描述】:
我有一个如下所示的数据框 df1:
cpc count gau
F21S41/32 5 {2875}
F21S41/147 21 {2875}
F21S41/692 20 {2875}
B60Q1/0041 15 {2683, 2875, 2844}
F21S43/40 15 {2875}
F21S41/435 14 {2875}
对于每一行,我想将计数乘以 gau 以生成一个名为 w_gau 的新列。
最后,我希望 df1 看起来像这样:
cpc count gau w_gau
F21S41/32 5 {2875} ['2875', '2875', '2875', '2875', '2875']
F21S41/147 3 {2875} ['2875', '2875', '2875']
F21S41/692 2 {2875} ['2875', '2875']
B60Q1/0041 2 {2683, 2875, 2844} ['2683', '2875', '2844', '2683', '2875', '2844', '2683', '2875', '2844']
F21S43/40 3 {2875} ['2875', '2875', '2875']
F21S41/435 4 {2875} ['2875', '2875', '2875', '2875']
我已经有代码可以将列表展平为单个列表并计算每个字符串的出现次数。
我的问题是如何将 df1 中的 gau 转换为可以乘以整数的列表列表?
我试过了:
In [16]: df1.gau.tolist()
但这会将列中的所有内容转换为单个列表。我需要每一行都包含一个列表,其中每个字符串或 int 都是列表中的一个字符串。
编辑:gau 是一个字符串,而不是一个 int
df1.dtypes
Out[24]:
cpc object
count int64
gau object
w_gau object
dtype: object
【问题讨论】:
标签: python-3.x pandas