【发布时间】:2016-09-02 13:14:37
【问题描述】:
我正在尝试开发一个脚本来运行保存在一个目录中的所有 spark sql 查询。 我已经能够在 Python 中做到这一点,但 pyspark 是一个不同的游戏。 下面是我用来读取和执行目录中所有查询文件的python脚本。
导入 sys,csv,sqlite3,codecs,unicodedata, string,glob, os,c conn=psycopg2.connect(数据库=“xxx”,用户=“xxxx”,密码=“xxxx”, host="localhost", port="5432") cur = conn.cursor() print("done")
with open("*.txt", "r") as ins: for line in ins:
words=line.split('|') print(words) query=words[0]
pmicode=words[1] 打印(查询) cur = conn.cursor() cur.execute(query) conn.commit() conn.close()
是否可以在 PySpark 中复制它?
谢谢, 潘卡伊
【问题讨论】: