【发布时间】:2016-07-19 23:41:56
【问题描述】:
我的 apache-spark (PySpark) 代码有一些输出,如下所示(每行非常简单的 JSON 对象):
{'id': 1, 'value1': 'blah', 'value2': 1, 'value3': '2016-07-19 19:35:13'}
{'id': 2, 'value1': 'yada', 'value2': 1, 'value3': '2016-07-19 19:35:13'}
{'id': 3, 'value1': 'blah', 'value2': 2, 'value3': '2016-07-19 19:35:13'}
{'id': 4, 'value1': 'yada', 'value2': 2, 'value3': '2016-07-19 19:35:13'}
{'id': 5, 'value1': 'blah', 'value2': 3, 'value3': '2016-07-19 19:35:13'}
{'id': 6, 'value1': 'yada', 'value2': 4, 'value3': '2016-07-19 19:35:13'}
我想将它们作为文档写入 DynamoDB 表。我不想将其转换为 Map 格式(如果可以避免的话)。关于如何解决这个问题的任何想法?关于格式问题的文档很少。
有一些新的 DocumentClient() 东西,但我不能从 CLI 中使用它。例如,将上述行之一作为项目提供给“put-item”aws cli 命令会产生错误:
aws dynamodb put-item --table-name mytable --item file://item.txt
Parameter validation failed:
Invalid type for parameter Item.......
【问题讨论】:
标签: json amazon-web-services amazon-s3 amazon-dynamodb