【发布时间】:2020-06-27 19:24:32
【问题描述】:
我想为组中的所有其他记录计算一个记录的函数,然后为每条记录取最大值。例如:
product, city, value
a, 1, str1
a, 1, str2
a, 1, str3
a, 2, str4
a, 2, str5
a, 2, str6
假设我的函数正在计算字符串中的相似度,那么我想计算 str1、str2 和 str1、str3 之间的相似度,并将最大值作为第一行的新列。 str2, str1 和 str2, str3 之间的相似性,并将最大值作为第二行的新列,依此类推,为每组产品,城市。
【问题讨论】:
-
您能否更具体地阐明您希望该功能做什么?字符串值似乎也是您想要的最大值,所以我不清楚您从问题的相似性/最大值部分想要什么。也许如果您玩一些字符串/值的实际示例会有所帮助。
-
我想计算这些字符串之间的相似度,并选择与特定行中的值最相似的那个
-
你如何给相似度打分?例如。 “abc”与“abd”或“abcd”最相似,“abc”与“aabc”或“abcc”最相似吗?
标签: python pandas pandas-groupby