【发布时间】:2021-04-18 08:21:42
【问题描述】:
我有一个包含大约 100 万条记录的文件。我需要为 id 提取具有不同 FName 和 LName 的记录。
输入文件
Col1,Col2,Col3,Col4,ID,FName,Col5,LName,Col6,Col7,Col8
AP,abc@gmail.com,xyz1,abc1,123,Ram,,Kumar,phn1,fax1,url1
AP,abc2@gmail.com,xyz2,abc2,123,Shyam,,Kumar,phn2,fax2,url1
AP,abc@gmail.com,xyz1,abc1,345,Raman,,Kumar,phn2,fax2,url1
AP,abc@gmail.com,xyz1,abc1,345,Raman,,Kumar,phn2,fax2,url1
AP,abc@gmail.com,xyz1,abc1,567,Alex,,Smith,phn2,fax2,url1
AP,abc@gmail.com,xyz1,abc1,789,Allen,,Prack,phn2,fax2,url1
我想看到的结果
AP,abc@gmail.com,xyz1,abc1,123,Ram,,Kumar,phn1,fax1,url1
AP,abc2@gmail.com,xyz2,abc2,123,Shyam,,Kumar,phn2,fax2,url1
任何 AWK 或 Sed 命令或脚本都可以提供帮助吗?谢谢
【问题讨论】:
-
请在您的问题中以代码的形式添加您的努力,这是非常鼓励的,谢谢。
-
当然。添加它。
-
您能否解释一下为什么
567,Alex,Smith和789,Allen,Prack行没有出现在预期的输出中,尽管它们的名字和姓氏是唯一的。 -
他们在文件中没有重复的 id。
-
请在您的问题中填写所有信息,不要分散在人们可能会错过的 cmets 中。我以为 abc1 和 abc2 是你的 ID 值。