【问题标题】:REGEX certain rows of Data and keep the rest正则表达式某些数据行并保留其余数据
【发布时间】:2022-10-14 10:39:05
【问题描述】:
我正在尝试提取以下数据并将其转换为 BigQuery 中的最后一列。
原始数据SAY LOWERS = BAD.Q
弗吉尼亚
SAY LOWERS = BAD.U
俄勒冈
乔治亚州
SAY LOWERS = BAD.U
SAY LOWERS = BAD.A
加利福尼亚
最终版本坏的
弗吉尼亚
坏掉
俄勒冈
乔治亚州
坏掉
坏的
加利福尼亚
基本上,我试图从所有拥有它的数据中删除“SAY LOWERS =”,并保留它之后的所有内容,并保留没有该短语的所有内容。
【问题讨论】:
标签:
regex
google-bigquery
text-extraction
【解决方案1】:
This answer 介绍了如何在 Google BigQuery 中运行 regexp_replace,以下是适合您的用例的查询:
SELECT regexp_replace(your_column_name, r'SAY LOWERS = ', '') final_column_name
FROM your_table_name
【解决方案2】:
您不需要正则表达式来从另一个字符串中删除常量字符串。只需使用REPLACE:
SELECT REPLACE(your_column, 'SAY LOWERS = ', '') AS final_column
FROM your_table