【问题标题】:Finding keywords in a column and adding those keywords in a new column against the same row在列中查找关键字并将这些关键字添加到同一行的新列中
【发布时间】:2020-02-10 09:54:00
【问题描述】:

我是 python 新手,这是我关于堆栈溢出的第一篇文章。我有一个关键字列表和一个包含多列的数据框。

我想在特定列中搜索这些关键字并写出出现在该列的关键字。

这就是我正在做的。 My code

这是我得到的错误。 The loop with the error

这就是我想要的。 Desired output

请帮助找出问题所在或提出更好的解决方法。谢谢! 如果它有助于使事情变得更容易,请编写下面的代码。

import pandas as pd

keywords = ["hello","hi","greetings","wassup"]

data = ["hello, my name is Harry", "Hi I am John", "Yo! Wassup", "Greetings fellow traveller","Hey im 
Henry", "Hello there General Kenobi"]

df = pd.DataFrame(data,columns = ['strings'])

df['Keywords'] = ""

df2 = pd.DataFrame(data = None, columns = df.columns)

for word in keywords:
     temp = df[df['strings'].str.contains(word,na = False)]
     temp.reset_index(drop = True)
     temp['Keywords'] = word
     df2.append(temp)

错误:

C:\Users\harka\Anaconda3\lib\site-packages\ipykernel_launcher.py:5: SettingWithCopyWarning: 试图在 DataFrame 中的切片副本上设置一个值。 尝试改用 .loc[row_indexer,col_indexer] = value

请参阅文档中的注意事项:http://pandas.pydata.org/pandas-docs/stable/indexing.html#indexing-view-versus-copy """

【问题讨论】:

    标签: python dataframe append contains


    【解决方案1】:

    我添加了'Yo'以表明它可以返回多个字符串

    import pandas as pd
    
    def keyword(row):
      strings = row['strings']
      keywords = ["hello","hi","greetings","wassup",'yo']
      keyword = [key for key in keywords if key.upper() in strings.upper()]
      return keyword
    
    data = ["hello, my name is Harry", "Hi I am John", "Yo! Wassup", "Greetings fellow traveller","Hey im Henry", "Hello there General Kenobi"]
    
    df = pd.DataFrame(data,columns = ['strings'])
    df['keyword'] = df.apply(keyword, axis=1)
    

    如果您不喜欢返回的字符串列表,那么可能是逗号分隔的字符串?

    import pandas as pd
    
    def keyword(row):
      strings = row['strings']
      keywords = ["hello","hi","greetings","wassup",'yo']
      keyword = [key for key in keywords if key.upper() in strings.upper()]
      return ','.join(keyword)
    
    data = ["hello, my name is Harry", "Hi I am John", "Yo! Wassup", "Greetings fellow traveller","Hey im Henry", "Hello there General Kenobi"]
    
    df = pd.DataFrame(data,columns = ['strings'])
    df['keyword'] = df.apply(keyword, axis=1)
    

    【讨论】:

      猜你喜欢
      • 2015-05-29
      • 1970-01-01
      • 2019-10-13
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多