【发布时间】:2018-11-11 11:41:47
【问题描述】:
所以我在 csv 文件 train.csv 中有一些火车数据,格式如下:
x;y;type
[1,2,3];[2,3,4];A
[2,7,9];[0,1,2];B
该文件被解析为pd.DataFrame,内容如下:
CSV_COLUMN_NAMES = ['x', 'y', 'type']
train = pd.read_csv("train.csv", names=CSV_COLUMN_NAMES, header=0, delimiter=";")
train['x'] = train['x'].apply(literal_eval)
train['y'] = train['y'].apply(literal_eval)
到目前为止一切顺利。应用了literal_eval 函数,因此x 和y 被视为数组。下一步是使用以下内容创建DataSet:
features, labels = train, train.pop('type')
dataset = tf.data.Dataset.from_tensor_slices((dict(features), labels))
这是它中断的地方:(它会溢出以下错误:
TypeError: Expected binary or unicode string, got [1, 2, 3]
为什么需要二进制或 unicode 字符串?是否不允许使用矢量特征列?还是我做错了什么?请给我一些启发
【问题讨论】:
标签: python pandas dataframe tensorflow