【发布时间】:2016-10-26 17:49:02
【问题描述】:
我对 Python 很陌生,所以请多多包涵。我有一个包含 csv 文件的文件夹,其中第一行是我需要处理的数据。所以我需要给他们列名,以便我以后可以调用它们。每个 csv 具有相同数量的列。在我的练习中,我使用了三列。
我了解如何将文件名添加到单个文件:
my_file = pd.read_csv('path\the_file.csv', names = ['first','second','third'])
但我需要转到我的目录并循环浏览大量 csv 文件。老实说,我什至不知道该怎么做(我知道很难过)。我已经设法使用 os.listdir 遍历文件名,但是当我需要其中的数据时,这对我没有多大用处。一旦我得到这些列名,我就知道该怎么做了。
尽可能使用 pandas 是非常可取的。我看了很多,但似乎找不到任何真正有效的东西。我真的很感激帮助!
编辑: 这是我将要做的一部分,但需要为文件夹中的所有 csv 文件做。
my_file = pd.read_csv('path\the_file.csv', names=['first','second','third'])
first_col = my_file['first']
second_col = my_file['second']
third_col = my_file['third']
key_codes = []
key_codes.append(second.map(str) + third.map(str))
所以,如果第 2 列有“123”,第 3 列有“4”,那么我正在制作“1234”,但现在我只需要弄清楚如何循环文件并为它们添加相同的名称/标题。
【问题讨论】:
-
我想我不明白这个问题。请清楚说明什么不起作用。
-
嗨@wiredflamingo,你能告诉我们你的步骤吗?请记住,SO 不是代码工厂,也不是外包代码编写...欢迎使用 SO 或类似...
-
当你循环所有文件时,想要的输出是什么?列表 od
DataFrames?或者您需要将所有数据帧合并为一个? -
抱歉,我有一个文件夹,里面有一堆 CSV 文件。我需要创建一个 for 循环,为每个 CSV 添加列名/标题。我不需要重写原始文件,只需要制作它,以便我可以调用代码中的列。例如,如果第 1 列显示“123”,第 2 列显示“4”,我会将其设为“1234”,但我知道该怎么做,我只需要能够调用这些列。希望这会有所帮助。
-
抱歉,您只需要添加列名并将每个列名写入新的 csv 吗?然后每个文件都有不同的标题或每个文件都有相同的标题?为什么需要熊猫?
标签: python csv for-loop pandas