elasticsearch - 如何在 Elasticsearch 的 date_histogram 选择器中选择最后一个桶
问题描述
我有一个date_histogram
,我可以用它max_bucket
来获取价值最大的桶,但我想选择最后一个桶(即时间戳最高的桶)。
使用max_bucket
来获得最大的价值可以,但我不知道该放什么buckets_path
来获得最后一个桶。
我的映射:
{
"ee-2020-02-28" : {
"mappings" : {
"dynamic" : "strict",
"properties" : {
"date" : {
"type" : "date"
},
"frequency" : {
"type" : "long"
},
"keyword" : {
"type" : "keyword"
},
"text" : {
"type" : "text"
}
}
}
}
}
我的工作查询,它以更高的频率返回当天的存储桶(之所以命名last_day
,是因为这是一个 WIP 查询以达到我的目标):
{
"query": {
"range": {
"date": { /* Start away from the begining of data, so the rolling avg is full */
"gte": "2019-02-18"/*,
"lte": "2020-12-14"*/
}
}
},
"aggs": {
"palabrejas": {
"terms": {
"field": "keyword",
"size": 100
},
"aggs": {
"nnndiario": {
"date_histogram": {
"field": "date",
"calendar_interval": "day"
},
"aggs": {
"dailyfreq": {
"sum": {
"field": "frequency"
}
}
}
},
"ventanuco": {
"avg_bucket": {
"buckets_path": "nnndiario>dailyfreq",
"gap_policy": "insert_zeros"
}
},
"last_day": {
"max_bucket": {
"buckets_path": "nnndiario>dailyfreq"
}
}
}
}
}
}
它的输出(注意我用 替换了长部分[...]
):
{
"aggregations" : {
"palabrejas" : {
"doc_count_error_upper_bound" : 0,
"sum_other_doc_count" : 0,
"buckets" : [
{
"key" : "rama0",
"doc_count" : 20400,
"nnndiario" : {
"buckets" : [
{
"key_as_string" : "2020-01-01T00:00:00.000Z",
"key" : 1577836800000,
"doc_count" : 600,
"dailyfreq" : {
"value" : 3000.0
}
},
{
"key_as_string" : "2020-01-02T00:00:00.000Z",
"key" : 1577923200000,
"doc_count" : 600,
"dailyfreq" : {
"value" : 3000.0
}
},
{
"key_as_string" : "2020-01-03T00:00:00.000Z",
"key" : 1578009600000,
"doc_count" : 600,
"dailyfreq" : {
"value" : 3000.0
}
},
[...]
{
"key_as_string" : "2020-01-31T00:00:00.000Z",
"key" : 1580428800000,
"doc_count" : 600,
"dailyfreq" : {
"value" : 3000.0
}
}
]
},
"ventanuco" : {
"value" : 3290.3225806451615
},
"last_day" : {
"value" : 12000.0,
"keys" : [
"2020-01-13T00:00:00.000Z"
]
}
},
{
"key" : "rama1",
"doc_count" : 20400,
"nnndiario" : {
"buckets" : [
{
"key_as_string" : "2020-01-01T00:00:00.000Z",
"key" : 1577836800000,
"doc_count" : 600,
"dailyfreq" : {
"value" : 3000.0
}
},
[...]
]
},
"ventanuco" : {
"value" : 3290.3225806451615
},
"last_day" : {
"value" : 12000.0,
"keys" : [
"2020-01-13T00:00:00.000Z"
]
}
},
[...]
}
]
}
}
}
我不知道该放什么last_day
来buckets_path
获得最后一个桶。
解决方案
您可以考虑使用terms
聚合而不是date_histogram
-aggregation:
"max_date_bucket_agg": {
"terms": {
"field": "date",
"size": 1,
"order": {"_key": "desc"}
}
}
问题可能是数据的粒度,您可以考虑将预期粒度(例如天)的日期值存储在单独的字段中,并在terms
-aggregation 中使用该字段。
推荐阅读
- flutter - 使用 GetIt 和 Injectable 注册路径提供程序时出现问题
- firebase - Spring Boot REST api 验证 Firebase JWT 令牌
- xamarin - CollectionView Xamarin 如何加速渲染
- plotly-python - 如何更改 plotly.express.bar 中的曲线标签
- sql - 如何统计同一列中SQL中的变体数量
- file - AppleScript 中的简单移动文件
- c# - 通过代码更新c#中datagridview中复选框列的值
- python - 编辑后以同名存储 PILLOW 图像
- react-native - 如何更改 React Navigation 选项卡栏中图标之间的间距?
- android - java.lang.IllegalStateException: Unable to create layer for WebView, RecyclerView after WebView under NestedScrollView