【发布时间】:2016-09-16 14:22:16
【问题描述】:
我有一个包含 1000 多列数据的 xlsx 文件。我想首先解析数据文件中的每一列(可以包含数字和字母),然后从解析的数据中创建一个唯一列表。
我完全是个菜鸟,我尝试过“for”和“do while”循环,但都没有为我工作。
到目前为止我有:
import pandas as pd
workbook = pd.read_excel('C:\Python27\Scripts\Data.xlsx')
worksheet = workbook.sheetname='Data'
for col in range(worksheet[0], worksheet[1300]):
print(col)
我想我需要附加数据并可能写入文本文件,然后从文本文件创建一个唯一列表 - 我可以做第二部分,它只是将它放入我遇到问题的文本文件中。
谢谢
【问题讨论】:
-
对不起,当您说每隔一列时,您是指第二列还是每个偶数列?你还想要一些全局列表还是每列一个列表?你也看过
unique吗? -
感谢 Ed,它是每个偶数列 - 0、2、4、6、8 等,或者 A、C、E、G、I 一直到 AWK。总共有 1286 列,所以我想从其中的 643 列中列出一个列表,然后从该列表中创建一个唯一列表。我肯定会使用 pandas.series.unique() 但我不确定如何将 643 列放入一个列表中。
标签: python-2.7 parsing pandas unique xlrd