【发布时间】:2018-04-17 05:43:12
【问题描述】:
我正在处理发生以下事件的大量名称数据:
在一个流中,数据以“Sung”形式提交,而在另一个流“Snug”中,我最初的想法是将 Sung 和 Snug 转换为每个字符等于一个数字的位置,然后总和将是相同的,所以即使如果他们横穿一个角色,我就可以适当地存储这些。
另一个是在一个流中它以“Lilly”的形式出现,而不是在另一个流中以“Lilly”出现。我想弄清楚如何模糊匹配这些以便我可以识别它们。我不确定这在 Oracle 中是否可行。
我正在处理数百万个数据点,并试图弄清楚如何编写这些分类桶,这样我就可以在我的主要任务中不再有太多噪音了错误。
任何想法将不胜感激。
【问题讨论】: