【发布时间】:2021-09-24 10:21:04
【问题描述】:
我正在尝试使用 Pyspark (Azure Databricks) 中的以下代码以结构化格式捕获 Azure Application Insights 事件 -
import requests
import json
appId = "..."
appKey = "..."
query = """traces | where timestamp > ago(1d) | order by timestamp"""
params = {"query": query}
headers = {'X-Api-Key': appKey}
url = f'https://api.applicationinsights.io/v1/apps/{appId}/query'
response = requests.get(url, headers=headers, params=params)
logs = json.loads(response.text)
json = json.dumps(logs)
jsonRDD = sc.parallelize([json])
df = spark.read.option('multiline', "true").json(jsonRDD)
display(df)
但是,由于某种原因,这仅返回 json 结构。如何将其转换为结构化或表格格式?
请帮忙!
【问题讨论】:
-
我尝试以不同的方式进行操作,但效果很好。不过感谢您的帮助。
-
您也可以将其发布为帮助其他社区成员的答案。
标签: json python-3.x pyspark azure-application-insights azure-databricks