【问题标题】:Google colab: read txt files and convert them to pandasGoogle colab:读取 txt 文件并将其转换为 pandas
【发布时间】:2023-02-03 00:15:31
【问题描述】:

我正在使用 google colab,有一个名为“examples”的文件,里面有三个 txt 文件。

我正在使用以下代码读取并将它们转换为熊猫

dataset_filepaths = glob.glob('examples/*.txt') 
for filepath in tqdm.tqdm(dataset_filepaths):
  df = pd.read_csv(filepath)

如果你打印 dataset_filepaths 你会看到

['examples/kate_middleton.txt',
 'examples/jane_doe.txt',
 'examples/daniel_craig.txt']

哪个是正确的。但是,在 df 中只有第一个文档。您能否让我知道我们如何按以下形式创建熊猫

index     text 
-----------------
0         text0
1         text1
.           .
.           .
.           .

【问题讨论】:

  • 你想要每个文件一个 DataFrame 吗?如果是,请执行dfs = [pd.read_csv(filepath) for filepath in tqdm.tqdm(dataset_filepaths)]
  • 如果您希望每个文本文件作为单独的数据帧,请创建一个列表并在 for 循环的每个步骤中将 df 附加到它。

标签: python


【解决方案1】:

我认为您需要在 pd.read_csv() 方法中提供相关的分隔符。默认情况下,分隔符是 ','。但在你的情况下,它应该是一个空格。

你应该试试

dataset_filepaths = glob.glob('examples/*.txt') 
for filepath in tqdm.tqdm(dataset_filepaths):
  df = pd.read_csv(filepath,sep=" ", header=None)

here所述。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2020-08-26
    • 2014-09-16
    • 2017-04-26
    • 2021-09-27
    • 2017-05-02
    • 2011-10-30
    • 1970-01-01
    相关资源
    最近更新 更多