【发布时间】:2020-08-14 16:33:47
【问题描述】:
我想从包含 csv 文件的桌面文件夹自动创建 BQ 表(即自动创建架构并加载到新表)
如果下次加载相同的文件,只需更新现有表,如果加载了新文件,则创建一个新表。是否可以使用 Python 实现自动化?
当前代码:
import pandas as pd
from google.cloud import bigquery
def bqDataLoad(event, context):
bucketName = event['test_vs']
blobName = event['gf-dev-models']
fileName = "gs://" + bucketName + "/" + blobName
bigqueryClient = bigquery.Client()
tableRef = bigqueryClient.dataset("gf-dev-models-204097").table("test_vs")
dataFrame = pd.read_csv(fileName) bigqueryJob = bigqueryClient.load_table_from_dataframe(dataFrame, tableRef) bigqueryJob.result()
#Project id = gf-dev-models
#dataset = gf-dev-models-204097
#table name = want a new table created
【问题讨论】:
-
@Soumendra Mishra - 如果我在 BigQuery 中没有现有表,如何在此代码中传递凭据以及如何自动创建架构?