【发布时间】:2019-04-09 15:27:38
【问题描述】:
我正在使用包含两列的 DataFrame,其中一列包含逗号分隔的字符串,第二列包含整数。我想用字符串遍历列,保存每一行中的每个唯一字符串,将第二列中的整数值分配给每个字符串。换句话说,
A B
a,b,c,d 0
a,b,c,d 10
a,b,d,e 89
a,b,d,e 111
在这个例子中:
a = 220, b = 220, c = 10, d = 220, e = 210
我正在从我的 csv 文件中选择有趣的列,
revcat = DataFrame(data, columns = ['Tag', 'Revenue'])
这为我提供了 'Tag' 中具有唯一值的 ndarray,并将其转换为另一个 DataFrame。
uniqtag = rev1.Tag.str.split(",").apply(pd.Series).stack().unique()
tag_stack = pd.DataFrame(uniqtag)
我被困在这里。基于此,我如何使用我找到的唯一字符串并将“收入”列中的值与每个“标签”相加来遍历原始“标签”列?
【问题讨论】: