【发布时间】:2021-04-19 15:19:17
【问题描述】:
下面的代码是用 Python 编写的,我想将此代码转换为 pyspark,基本上 我不确定语句的代码是什么 - pd.read_sql(query,connect_to_hive) 转换为 pyspark
需要从 EDL 中提取数据,因此使用 PYODBC 连接到 EDL,然后使用 sql 查询提取数据。
pyodbc 连接到企业数据湖:
connect_to_hive = pyodbc.connect("DSN=Hive", autocommit=True)
transaction=pd.read_sql(query, connect_to_hive)
connect_to_hive.close()
#Query函数:下面只是一个基本的sql查询来复制这个问题。
query=f'''
with trans as (
SELECT
a.employee_name,
a.employee_id
FROM EMP
'''
【问题讨论】:
标签: python apache-spark pyspark apache-spark-sql pyodbc