【发布时间】:2016-06-23 06:10:05
【问题描述】:
我有一个大数据文件,我需要删除包含某些关键字的行。
这是我正在使用的文件的示例:
User Name DN
MB31212 CN=MB31212,CN=Users,DC=prod,DC=trovp,DC=net
MB23423 CN=MB23423 ,OU=Generic Mailbox,DC=prod,DC=trovp,DC=net
MB23424 CN=MB23424 ,CN=Users,DC=prod,DC=trovp,DC=net
MB23423 CN=MB23423,OU=DNA,DC=prod,DC=trovp,DC=net
MB23234 CN=MB23234 ,OU=DNA,DC=prod,DC=trovp,DC=net
这是我导入文件的方式:
import pandas as pd
df = pd.read_csv('sample.csv', sep=',', encoding='latin1')
我该怎么做
- 例如删除 DN 列中包含“OU=DNA”的所有行?
- 如何删除 DN 列中的第一个属性“CN= x”而不删除该列中的其余数据?
我想得到类似于下面发布的内容,删除了包含“OU=DNA”的 2 行,并从每一行中删除了“CN=x”:
User Name DN
MB31212 CN=Users,DC=prod,DC=trovp,DC=net
MB23423 OU=Generic Mailbox,DC=prod,DC=trovp,DC=net
MB23424 CN=Users,DC=prod,DC=trovp,DC=net
【问题讨论】:
-
我建议使用 grep 删除行,使用 awk 删除列
标签: python python-3.x pandas