【发布时间】:2020-06-17 12:59:33
【问题描述】:
我正在处理列中的一些大文本字段。经过一些清理后,我有如下内容:
truth_val: ["5"]
xerb Scale: ["2"]
perb Scale: ["1"]
我想提取数字 2。我正在尝试匹配字符串“xerb Scale”,然后提取 2。我尝试将包含 2 的组捕获为(?:xerb Scale:\s\[\")\d{1},并尝试通过否定的外观排除匹配的组领先但没有运气。
这将在 SQL 查询中,我试图通过 REGEXP_EXTRACT() 函数提取数值。此查询是将此信息加载到数据库中的管道的一部分。
任何帮助将不胜感激!
【问题讨论】:
-
@PiotrFindeisen 是的,我在 presto 中使用了相同的正则表达式函数。我正在寻找合适的模式来使用。