【发布时间】:2013-09-02 20:51:35
【问题描述】:
我需要对一个结构如下的csv做一些数据处理:
我需要为 FIELD 条目为空的行折叠 TEXT 列中的所有数据,并使其看起来像这样:
FIELD TEXT
P0190001, RACE OF HOUSEHOLDER BY HOUSEHOLD TYPE(8) Universe:Households White Family Households: Married-couple family: With related children
P0190002, RACE OF HOUSEHOLDER BY HOUSEHOLD TYPE(8) Universe:Households White Family Households: Married-couple family: No related children
...等等。(FIELD中第一个有效条目之前的空白条目数并不总是两个,可能或多或少)
对于大型(60,000 个独特的“字段”)csv 文件,是否有一种简单有效的方法来执行此操作?我正在寻找在命令行上执行此操作而不是编写程序的方法。
【问题讨论】:
-
LH 列是否会随着每个新类别而变化?
-
LH 列确实发生了变化,但完全无关紧要。我不需要它。
-
如果您有 60,000 个,LH 允许您为类别编制索引。你能发布一个更大的样本吗?
标签: python shell csv data-structures text-files