【发布时间】:2021-01-20 17:45:48
【问题描述】:
我想重新格式化一个纯 ascii 文件 test.txt,其中包含(只是几百行中的 10 行样本):
{0.91, 0.87, -69.79,
-0.3149, 0.05}, {0.9392,
1.089, 69, -0.31,
0.052}, {-0.8768, 0.7025,
69.80, -0.314, 0.053},
{0.930, -1.2638750861516, 69.79,
0.314, 0.05301}, {0.9367,
-1.368063705085268, 69.79962, -0.31,
0.052}, {0.946, -1.644,
69.7, 0.3, 0.052}
到最终文件 test_processed.txt,其中包含(对于同一样本):
0.91, 0.87, -69.79, -0.3149, 0.05
0.9392, 1.089, 69, -0.31, 0.052
-0.8768, 0.7025, 69.80, -0.314, 0.053
0.930, -1.2638750861516, 69.79, 0.314, 0.05301
0.9367, -1.368063705085268, 69.79962, -0.31, 0.052}
0.946, -1.644, 69.7, 0.3, 0.052
也就是说,一个普通的 CSV 文件,每一行正好包含原始匹配大括号对中的五个字段。
我试着用 gawk 和 regex'es 摆弄一下,但不知道如何管理它;我觉得使用 awk 的变量 RS 和 ORS 进行调整可能会有所帮助,但无法继续前进......
【问题讨论】:
标签: regex awk text-processing