【问题标题】:How to Convert T-SQL IF statement to Databricks PySpark如何将 T-SQL IF 语句转换为 Databricks PySpark
【发布时间】:2023-01-13 06:03:02
【问题描述】:

我在 T-SQL 中有以下代码

IF NOT EXISTS (   SELECT     *   FROM     INFORMATION_SCHEMA.COLUMNS   WHERE     TABLE_NAME = 'airports' AND COLUMN_NAME = 'airport_region') SELECT * FROM airports;

我想将上面的 T-SQL 转换为 Pyspark。

我有以下数据框

df = df1.createOrReplaceTempView('airports')

我尝试转换以上内容如下:

sql("""IF NOT EXISTS(SELECT * FROM airports  where table = airports and COLUMN = 'airport_region') select * from airports""")

上面给了我一个 ParseException: 错误。

有什么想法吗?

【问题讨论】:

  • 我是否正确理解 df1 是您的机场数据集,如果它不包含“airport_region”列,您只想对它做些什么?如果是这样,你可以简单地做if not 'airport_region' in df1.columns: <do stuff>。如果没有,那么进一步澄清会更好。
  • 嗨@ScootCork,这是正确的。谢谢
  • 嗨@ScootCork,你能提供一个完整的例子吗?我有点困惑
  • 嗨@ScootCork,在尝试你的建议后我仍然收到 ParseException 错误。

标签: pyspark azure-databricks


【解决方案1】:

尝试这个:

if('airport_region' not in df1.columns):
    <do stuff>

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-03-13
    • 1970-01-01
    • 2022-01-19
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多