【发布时间】:2019-10-23 20:58:26
【问题描述】:
我的 CSV 文件如下所示:
idx messages
112 I have a car and it is blue
114 I have a bike and it is red
115 I don't have any car
117 I don't have any bike
我想要读取文件并执行相似度差异的代码。
我查看了很多关于此的帖子,例如1234,但要么我很难理解,要么不完全是我想要的。
基于一些帖子和网页说“一个简单而有效的方法是余弦相似度”或“通用句子编码器”或“Levenshtein 距离”。
如果你能提供我也可以在我身边运行的代码,那就太好了。谢谢
【问题讨论】:
标签: python pandas csv dataframe nlp