【发布时间】:2021-10-30 10:31:17
【问题描述】:
当我想加载以下数据集时出现值错误。 我跳过了第一行,因为它在某些来源中说“不要取标题 - 第一行”。但它又在另一行给出了错误。
from numpy import loadtxt
path = r"C:\Users\emre.yildirim\Desktop\Dominos_Stock_Data.csv"
datapath = open(path,'r')
data = loadtxt(datapath,delimiter=",")
ValueError:无法将字符串转换为浮点数:“日期”
from numpy import loadtxt
path = r"C:\Users\emre.yildirim\Desktop\Dominos_Stock_Data.csv"
datapath = open(path,'r')
data = loadtxt(datapath,delimiter=",",skiprows=1)
ValueError:无法将字符串转换为浮点数:'2019-10-16'
【问题讨论】:
-
尝试
genfromtxt而不是loadtxt -
检查docs:
dtype是“结果数组的数据类型”,默认为float。2019-10-16不是浮点数。请提供架构或使用genfromtxt。 -
@GhostOps 谢谢,但 print(data[:1]) 给出的结果为 [[nan nan nan nan nan nan]] 为什么?
-
@Cocojombo 我认为这是因为并非矩阵中的所有值都是浮动的,因为第一行有字母,所以我猜是 numpy 替换为 nan
-
@Cocojombo 我对此一无所知,我尝试在一个 numpy 数组中打印
254.89,它按原样打印,但是当我添加一些像72814887这样的整数时,它开始每隔一个打印号码如...e+blabla