【发布时间】:2023-02-03 00:15:31
【问题描述】:
我正在使用 google colab,有一个名为“examples”的文件,里面有三个 txt 文件。
我正在使用以下代码读取并将它们转换为熊猫
dataset_filepaths = glob.glob('examples/*.txt')
for filepath in tqdm.tqdm(dataset_filepaths):
df = pd.read_csv(filepath)
如果你打印 dataset_filepaths 你会看到
['examples/kate_middleton.txt',
'examples/jane_doe.txt',
'examples/daniel_craig.txt']
哪个是正确的。但是,在 df 中只有第一个文档。您能否让我知道我们如何按以下形式创建熊猫
index text
-----------------
0 text0
1 text1
. .
. .
. .
【问题讨论】:
-
你想要每个文件一个 DataFrame 吗?如果是,请执行
dfs = [pd.read_csv(filepath) for filepath in tqdm.tqdm(dataset_filepaths)] -
如果您希望每个文本文件作为单独的数据帧,请创建一个列表并在 for 循环的每个步骤中将 df 附加到它。
标签: python