【问题标题】:Parsing disparate excel sheets (pandas)解析不同的excel表(熊猫)
【发布时间】:2020-10-19 19:51:13
【问题描述】:

我正在从多页 Excel 文件中读取数据,格式为:

我有兴趣对每个 id 类 A、B、C 等进行价格与数量的回归。 在处理第一种类型的工作表时,我只是使用

df = pd.read_excel('./question.xlsx', sheet_name = j, header = 1)

(然后从工作表的名称中获取标识符)。 当我阅读第二种类型的工作表时,我得到如下信息:

我很难处理。

然后是我的问题

  • 问题 1 是关于第二种类型的工作表:如何区分不同类别的数据?
  • 问题 2 是关于这两种类型的混合:我需要一个适用于这两种类型的解析过程,即我需要检测我正在处理的工作表类型。

【问题讨论】:

    标签: python excel pandas


    【解决方案1】:

    我找到的解决方案是使用多索引:

    df = pd.read_excel('./question.xlsx', sheet_name = 1, header = [0,1])
    

    导致

    可以通过 Multiindex 明确访问数据的位置:

    然而,这造成了列名缺失值的问题(请参阅here)。

    【讨论】:

      猜你喜欢
      • 2014-08-21
      • 1970-01-01
      • 1970-01-01
      • 2019-11-29
      • 2019-11-17
      • 2017-07-22
      • 2019-11-27
      • 1970-01-01
      • 2020-12-18
      相关资源
      最近更新 更多