【发布时间】:2015-07-27 21:13:33
【问题描述】:
我有一个联系信息的 .csv 文件,我将其作为 pandas 数据框导入。
>>> import pandas as pd
>>>
>>> df = pd.read_csv('data.csv')
>>> df.head()
fName lName email title
0 John Smith jsmith@gmail.com CEO
1 Joe Schmo jschmo@business.com Bagger
2 Some Person some.person@hotmail.com Clerk
导入数据后,我想删除一个字段包含列表中多个子字符串之一的行。例如:
to_drop = ['Clerk', 'Bagger']
for i in range(len(df)):
for k in range(len(to_drop)):
if to_drop[k] in df.title[i]:
# some code to drop the rows from the data frame
df.to_csv("results.csv")
在 Pandas 中执行此操作的首选方法是什么?这甚至应该是一个后处理步骤,还是首先在写入数据帧之前对其进行过滤?我的想法是,在数据框对象中操作一次会更容易。
【问题讨论】: