【发布时间】:2021-09-06 11:36:37
【问题描述】:
我在 google colab 上遇到了这个问题:电子表格变成了带有 read_csv 的列表
原始文件是一个 3 列、6219 行(包括列标题)的蛋白质序列表: |未命名:0|aaSequence|中值亮度| |----------------------|------------------|-------- ----------| |0|MSQEGDYGRWTISSSDESEEEKPKPDK|80000000.0| |1|MSQEGDYGRWTISSSDESEEEKPKPDK|100000000.0|
不确定我的表格是否显示,预览中看起来像这样(蛋白质截断):
我运行了这段代码:
df = pd.read_csv('/content/hydrolase_padded.csv')
当我打印出df 时,它会返回一个列表,其中包含我在数据集中从未见过的数字,长度为 6218:
[3500, 3605, 4804, 300, 2832, 6106, 2057, 4958, 3468, 2944, 4197, 3164, 5108, 679, ....]
有人知道会发生什么吗?
【问题讨论】:
-
df是否只有一列包含这些数字?还是有 3 列?当你运行df.info()时你会得到什么? -
只有一个,我会检查的!
标签: python pandas list csv google-colaboratory