【发布时间】:2015-04-08 15:36:16
【问题描述】:
使用以下 PyMongo 查询。我使用了 Mongo Webinar 中的一些技巧,他们建议使用 _id 字段来存储时间戳,以提高性能和内存使用率。
cursor = db.dados_meteo_reloaded.aggregate( [
{
"$match": {
"_id": {
"$gte": "0001:20120901",
"$lte": "0001:20140215"
},
"TMP": {
"$lt": 7.2
}
}
},
{
"$project": {
"year": {
"$substr": [
"$_id",
5,
4
]
},
"month": {
"$substr": [
"$_id",
9,
2
]
},
"day": {
"$substr": [
"$_id",
11,
2
]
}
}
},
{
"$group": {
"_id": {"year":"$year","month":"$month","day":"$day"},
"frio": {
"$sum": 0.25
}
}
},
{"$sort":{"_id.year":1, "_id.month":1, "_id.day":1}}
])
我得到的结果只按天排序。当,在管道的 $sort 步骤中,我只使用
{"$sort":{"_id.year":1, "_id.month":1}
结果按年份和月份正确排序。 $sort 步骤中可以使用的字段数量是否有限制?
这里是一些示例文档
{
"_id" : "0001:20121201000000",
"RNF" : 0,
"WET" : 8,
"HMD" : 100,
"TMP" : 4.4
},
{
"_id" : "0001:20121201001500",
"RNF" : 0,
"WET" : 7.9,
"HMD" : 100,
"TMP" : 4.2
}
【问题讨论】:
-
不,据我所知没有限制。您能否向我们展示一些示例文档,尤其是在管道中未正确排序的少数文档?
-
@wdberkeley。完成。谢谢。
标签: mongodb sorting aggregation-framework