【发布时间】:2017-11-17 23:49:51
【问题描述】:
我正在使用 带有散列桶的分类列 和 Crossed Feature Columns 作为特征列的数量为相当宽和稀疏的数据拟合线性分类器。
稍后我想在自定义服务基础架构中使用模型的权重/系数。我知道如何从模型中提取权重,但显然,对于上述列,它们来自已经散列的特征值。
我可以使用 tf.string_to_hash_bucket_fast 为简单的分类列重建一个哈希表(值 -> 哈希值),但是对于交叉特征列我会遇到麻烦。
对于构建交叉列的两个分类列的一对值 - 我如何了解它们将进入哪个存储桶?
【问题讨论】:
-
更改问题的标题
标签: python tensorflow