【发布时间】:2022-01-18 22:51:22
【问题描述】:
我有一个场景,我们将 apache spark 与 sql server 连接,将表的数据加载到 spark 中并从中生成 aparquet 文件。
这是我的代码的 sn-p:
val database = "testdb"
val jdbcDF = (spark.read.format("jdbc")
.option("url", "jdbc:sqlserver://DESKTOP-694SPLH:1433;integratedSecurity=true;databaseName="+database)
.option("dbtable", "employee")
.option("driver", "com.microsoft.sqlserver.jdbc.SQLServerDriver")
.load())
jdbcDF.write.parquet("/tmp/output/people.parquet")
它在 spark shell 中运行良好,但我想在 Windows PowerShell 或 Windows 命令脚本 (批处理文件) 中自动执行此操作,以便它成为 SQL Server 作业的一部分。
如果有任何建议或线索,我将不胜感激。
【问题讨论】:
标签: windows scala powershell apache-spark batch-file