【问题标题】:Data cleaning using pandas from excel file in Python在 Python 中使用来自 excel 文件的 pandas 进行数据清理
【发布时间】:2021-01-13 10:39:50
【问题描述】:

我正在尝试修改或清理 DataFrame,使其看起来像此处添加的图片:1。我想出了如何删除较高的值(因为 excel 文件在前两行中是空的),但不知道如何从 5 和向下删除值。我曾尝试使用 skiprows= range 函数,但我已经使用它来跳过我拥有的 excel 文件中的第一行。我的excel文件总共有298行,所以我想消除DataFrame中从5到298的所有行。

我用过的代码直到知道:

from pathlib import Path 
src_file = Path.cwd() /  'a1_data1.xlsx'

df = pd.read_excel(src_file, header=1, usecols='B', skiprows =
range(0,1)) 
df = np.round(df, 1)
df

有人知道怎么做吗?

谢谢 阿德里安

【问题讨论】:

  • 您好,欢迎来到 SO。请在打印df时显示您当前得到的内容。

标签: python pandas data-cleaning


【解决方案1】:
df = pd.read_excel(src_file, header=1, usecols='B', skiprows = range(0,1))
df = np.round(df, 1) 
df = df.head(5)
df

你会的,head(5) 给你前 5 行

【讨论】:

    【解决方案2】:
    df.head(5) # for First Five Rows
    
    df.tail(5) # for Last Five Rows
    

    【讨论】:

      【解决方案3】:
      df = pd.concat([df.iloc[:4,:], df.iloc[298:,:]], ignore_index=True, sort=False)
      

      现在您消除了从 5 到 298 之间的所有行。我不确定您是否要保留第 5 个。所以请自行调整。

      【讨论】:

        猜你喜欢
        • 2017-07-03
        • 2021-11-08
        • 2021-07-01
        • 2012-06-25
        • 2019-09-07
        • 1970-01-01
        • 1970-01-01
        • 2020-07-10
        • 1970-01-01
        相关资源
        最近更新 更多