【问题标题】:getting dtype error while opening the .csv file in jupyter notebook在 jupyter notebook 中打开 .csv 文件时出现 dtype 错误
【发布时间】:2020-01-16 01:35:23
【问题描述】:

在 windows 环境下的 jupyter notebook 中打开 .csv 文件时出现以下错误。

Salaries = pd.read_csv('Salaries.csv')

C:\Anaconda3\lib\site-packages\IPython\core\interactiveshell.py:3057: DtypeWarning: 列 (3,4,5,6,12) 有混合类型。在导入时指定 dtype 选项或设置 low_memory=False。 交互性=交互性,编译器=编译器,结果=结果)

如果我调用文件,我可以看到文件的内容,但是当我应用 .mean() 时,出现以下错误。

Salaries['BasePay'].mean()

TypeError: +: 'float' 和 'str' 的操作数类型不受支持

尝试应用另一个函数

Salaries['BasePay'].max()

TypeError: 'float' 和 'str' 的实例之间不支持 '>='

【问题讨论】:

  • 没有 csv,就很难说什么。它接缝一些列有字符串并在其中浮动。
  • 感谢您的建议,我已经从 Kaggle.com 下载了文件。我相信网站。因为我没有上传文件的选项,所以我提到了文件路径。 kaggle.com/kaggle/sf-salaries

标签: python-3.x jupyter-notebook


【解决方案1】:
read_csv(..., dtype={‘a’: np.float64, ‘b’: np.int32, ‘c’: ‘Int64'})

需要指定每一列的数据类型

【讨论】:

    【解决方案2】:

    您可以简单地将low_memory=False 分配给您的路径,如下所示:

    Salaries = pd.read_csv('Salaries.csv', low_memory=False)
    

    【讨论】:

      猜你喜欢
      • 2023-01-05
      • 2020-03-06
      • 2019-11-16
      • 2021-03-31
      • 2020-07-14
      • 1970-01-01
      • 2020-02-08
      • 1970-01-01
      • 2020-10-15
      相关资源
      最近更新 更多