【发布时间】:2018-08-05 20:39:37
【问题描述】:
我有一个熊猫数据框。
keyword adGroup goal6Value adCost
aaaa (not set) 0 0.0
+bbbb (not set) 0 0.0
+cccc (not set) 2072 0.0
dddd (not set) 0 0.0
我更改了第一列中的值,根据某些条件为关键字添加括号(如果没有“+”符号,则添加括号)。
keyword adGroup goal6Value adCost
[aaaa] (not set) 0 0.0
+bbbb (not set) 0 0.0
+cccc (not set) 2072 0.0
[dddd] (not set) 0 0.0
这是添加括号的函数:
def add_bracket(df):
df["keyword"] = df["keyword"].astype('str')
keyword_list = list()
for index, row in df.iterrows():
keyword = row["keyword"]
if keyword.find("+") < 0:
keyword = "[" + keyword + "]"
keyword_list.append(keyword)
kw = pd.DataFrame(keyword_list, columns = ['Keyword2'])
df2 = pd.concat([df, kw], axis=1).drop(columns["keyword"]).rename(columns={'Keyword2': 'keyword'})
df2 = df2[['keyword', 'adGroup', 'goal6Value', 'adCost']]
return df2
该函数产生了我想要的结果,但是在 pandas 中是否有更简洁的方法,这样我就不需要创建 df2 来添加第 1 列的输出(基本上是在原地进行更改) ?
解决方案: 根据@Inder 的建议答案,整个函数可以写在一行中。
df["keyword"] = df.keyword.apply(lambda x: "[" + x + "]" if x.find("+") < 0 else x)
基于@RafaelC 的回答。
mask = df.keyword.str.contains('+', regex=False)
df.loc[~mask, 'keyword'] = "[" + df.loc[~mask, 'keyword'] + "]"
【问题讨论】:
-
@coldspeed 将关键字与另一个文档匹配