【发布时间】:2015-04-25 14:27:56
【问题描述】:
我有一个包含大约 300 列的 csv 文件。
我正在使用 awk 创建此文件的子集,其中第 24 列是“CA”。
数据示例:
这是我正在尝试的:
awk -F "," '{if($24~/CA/)print}' myfile.csv > subset.csv
大约 10 分钟后,子集文件增长到 400 mb,然后我杀死了它,因为这太慢了。
我怎样才能加快速度?也许是 sed / awk 的组合?
\
【问题讨论】:
-
试试
awk -F, '$24=="CA"' myfile.csv -
@AvinashRaj 相同
-
这真是难以置信。这是具有 24 GB RAM 的 i7 四核,运行全新安装的 ubuntu。为什么要花这么长时间?