【发布时间】:2015-07-06 06:49:47
【问题描述】:
我有一个 csv 文件,其中包含 65000 行(大小约为 28 MB)。在每一行中,都给出了开头的特定路径,例如"c:\abc\bcd\def\123\456"。现在假设路径"c:\abc\bcd\" 在所有行中都是通用的,其余内容不同。我必须使用 python 脚本从所有行中删除公共部分(在本例中为 "c:\abc\bcd\")。例如CSV文件的内容如前所述。
C:/Abc/bcd/Def/Test/temp/test/GLNext/FILE0.frag 0 0 0
C:/Abc/bcd/Def/Test/temp/test/GLNext/FILE0.vert 0 0 0
C:/Abc/bcd/Def/Test/temp/test/GLNext/FILE0.link-link-0.frag 16 24 3
C:/Abc/bcd/Def/Test/temp/test/GLNext/FILE0.link-link-0.vert 87 116 69
C:/Abc/bcd/Def/Test/temp/test/GLNext/FILE0.link-link-0.vert.bin 75 95 61
C:/Abc/bcd/Def/Test/temp/test/GLNext/FILE0.link-link-0 0 0
C:/Abc/bcd/Def/Test/temp/test/GLNext/FILE0.link-link-6 0 0 0
在上面的例子中,我需要如下输出
FILE0.frag 0 0 0
FILE0.vert 0 0 0
FILE0.link-link-0.frag 17 25 2
FILE0.link-link-0.vert 85 111 68
FILE0.link-link-0.vert.bin 77 97 60
FILE0.link-link-0 0 0
FILE0.link 0 0 0
你们中的任何人都可以帮我解决这个问题吗?
【问题讨论】:
-
到目前为止你尝试了什么?
-
删除最后一个反斜杠之前的所有字符怎么样?
-
从问题中不清楚“常见”部分是否要自动检测?
-
嗨阿维纳什。感谢您的回复。我是 python 新手,并试图了解 python 如何处理文件。由于必须对目录和子目录中的多个文件执行此操作,因此我为此使用 os.walk。
-
Henrik,如果我们将公共部分存储在某个变量中怎么样,因为它总是相同的?