【发布时间】:2021-12-22 17:38:13
【问题描述】:
我只是很难理解这一点,当我处理大量文本数据集时,如何列出最外层的字段?我正在尝试在 Mongodb 和 pymongo 中实现它?有什么建议吗?
【问题讨论】:
-
你能举个例子,有一些样本数据和预期的输出吗?
-
所以我实际上在 Json 文件中有一些 covid-19 数据。我通过 pymongo 导入的数据似乎是大量数据,所以当我在 if 语句中执行“insert_many”和“insert_one”时,它给了我一些错误,但它显示了具有“-id”的输出,并且有 8/9 属性可用的。所以我试图列出它的最外层但没能做到。所以我想知道是否有任何建议。
-
类似的东西,知道如何根据其外部字段列出它{"_id":"868998797","id":"8567474","infons":{},"段落":[{"infons":{"license":"这篇文章(abc)","name_1":"surname: xyz;given-names:abc","section_type":"TITLE","article-id_pmid":"33647988"," name_0":"surname:xyss;given-names:aaa","year":"2000","article-id_pmc":"353543","article-id_publisher-id":"aba32","kwd":" COVID-19 SARS-CoV-2 C"...
-
如果可以的话更新问题:) 添加所有额外的细节,在代码块中添加 JSON 以便我们阅读。
-
这里不能分享图片,但是关键属性有:“_id”、“id”、“info”、“pass”、“pid”、“pcid”、“jrn”、“ yr", "aut" .....这些是可用的属性,我在 Pymongo 中尝试执行的查询是:“列出文档语料库的最外层字段”;我不确定我需要使用 python 列出的最外层字段是什么,对此有任何帮助,不知道如何在 python 上执行此操作
标签: python mongodb pymongo data-mining text-mining