【发布时间】:2021-09-02 08:47:31
【问题描述】:
我使用 Dask 读取 2.5GB 的 csv 文件,Python 给了我错误。这是我写的代码:
import pandas as pd
import numpy as np
import time
from dask import dataframe as df1
s_time_dask = time.time()
dask_df = df1.read_csv('3SPACK_N150_7Ah_PressureDistributionStudy_Data_Matrix.csv')
e_time_dask = time.time()
以下是我从 Python 得到的错误:
dask_df = df1.read_csv('3SPACK_N150_7Ah_PressureDistributionStudy_Data_Matrix.csv')
文件“C:\ProgramData\Anaconda3\lib\site-packages\dask\dataframe\io\csv.py”,第 645 行,正在读取 返回 read_pandas(
文件“C:\ProgramData\Anaconda3\lib\site-packages\dask\dataframe\io\csv.py”,第 525 行,在 read_pandas head = reader(BytesIO(b_sample), **kwargs)
文件“C:\ProgramData\Anaconda3\lib\site-packages\pandas\io\parsers.py”,第 686 行,在 read_csv 中 return _read(filepath_or_buffer, kwds)
文件“C:\ProgramData\Anaconda3\lib\site-packages\pandas\io\parsers.py”,第 458 行,在 _read 数据 = parser.read(nrows)
文件“C:\ProgramData\Anaconda3\lib\site-packages\pandas\io\parsers.py”,第 1196 行,正在读取 ret = self._engine.read(nrows)
文件“C:\ProgramData\Anaconda3\lib\site-packages\pandas\io\parsers.py”,第 2155 行,正在读取 数据 = self._reader.read(nrows)
文件“pandas_libs\parsers.pyx”,第 847 行,在 pandas._libs.parsers.TextReader.read 中
文件“pandas_libs\parsers.pyx”,第 862 行,在 pandas._libs.parsers.TextReader._read_low_memory
文件“pandas_libs\parsers.pyx”,第 918 行,在 pandas._libs.parsers.TextReader._read_rows 中
文件“pandas_libs\parsers.pyx”,第 905 行,在 pandas._libs.parsers.TextReader._tokenize_rows
文件“pandas_libs\parsers.pyx”,第 2042 行,在 pandas._libs.parsers.raise_parser_error 中
ParserError:标记数据时出错。 C 错误:第 43 行中应有 1 个字段,看到 9
你能帮我解决这个问题吗?
谢谢
【问题讨论】:
标签: python dataframe csv parsing dask