【发布时间】:2022-11-21 10:27:02
【问题描述】:
我正在使用 ScaNN 执行相似性搜索,并希望在执行相似性搜索时比其他功能更强调某些功能。
例如,如果我有以下数据
name | age | country | income
John 29 US $47k
Susan 28 US $44k
Bill 26 US $39k
Sarah 35 UK $100k
Jack 34 UK $90k
Maggie 37 UK $95k
和收入更重要,然后给出以下查询:
George, 28, US, $100k
它会返回
Sarah, Jack, Maggie
增加收入特征的权重。
在建立相似性指数之前对训练数据值进行归一化
df_np = preprocessing.normalize(df[features])
同样,查询值在执行搜索之前被规范化
np_q = preprocessing.normalize([list(query.values())])
更新
【问题讨论】: