ES聚合查询详解(一)

简介: ES聚合查询详解(一)

前言


本文主要介绍ES中的聚合查询。


一、聚合查询简介


聚合查询可以将数据汇总为度量、统计或其他分析。


聚合查询主要分为三个类别:


Metric 指标聚合

Bucket 桶聚合

Pipeline 管道聚合


二、聚合函数的使用


1、如何运行一个聚合查询

GET /my-index-000001/_search
{
  "aggs": {
    "my-agg-name": {
      "terms": {
        "field": "my-field"
      }
    }
  }
}


说明:

aggs 说明采用的是聚合查询

my-agg-name 是聚合查询的名称

terms 说明采用的是Terms aggregation多值聚合:一个基于多桶值源的聚合,其中桶是动态构建的——每个唯一值一个桶。统计每个唯一值的个数。

field 指定需要统计的字段。


2、限制聚合查询的范围

GET /my-index-000001/_search
{
  "query": {
    "range": {
      "@timestamp": {
        "gte": "now-1d/d",
        "lt": "now/d"
      }
    }
  },
  "aggs": {
    "my-agg-name": {
      "terms": {
        "field": "my-field"
      }
    }
  }
}


3、仅返回聚合结果

默认情况下,包含聚合的查询会同时返回搜索命中的结果和聚合结果。若要只返回聚合结果,请将大小设置为0

GET /my-index-000001/_search
{
  "size": 0,
  "aggs": {
    "my-agg-name": {
      "terms": {
        "field": "my-field"
      }
    }
  }
}

4、运行多个聚合

GET /my-index-000001/_search
{
  "aggs": {
    "my-first-agg-name": {
      "terms": {
        "field": "my-field"
      }
    },
    "my-second-agg-name": {
      "avg": {
        "field": "my-other-field"
      }
    }
  }
}

5、子聚合

统计索引中my-field字段的每个唯一值的记录数,并计算每组记录中my-other-field字段的平均值。

典型的场景:先分组,再计算

GET /my-index-000001/_search
{
  "aggs": {
    "my-agg-name": {
      "terms": {
        "field": "my-field"
      },
      "aggs": {
        "my-sub-agg-name": {
          "avg": {
            "field": "my-other-field"
          }
        }
      }
    }
  }
}

执行结果:

{
  ...
  "aggregations": {
    "my-agg-name": {                           
      "doc_count_error_upper_bound": 0,
      "sum_other_doc_count": 0,
      "buckets": [
        {
          "key": "foo",
          "doc_count": 5,
          "my-sub-agg-name": {                 
            "value": 75.0
          }
        }
      ]
    }
  }
}


6、聚合查询中使用scripts脚本

采用script脚本提取运行时字段,并对运行时字段message.length进行聚合。

GET /my-index-000001/_search?size=0
{
  "runtime_mappings": {
    "message.length": {
      "type": "long",
      "script": "emit(doc['message.keyword'].value.length())"
    }
  },
  "aggs": {
    "message_length": {
      "histogram": {
        "interval": 10,
        "field": "message.length"
      }
    }
  }
}


7、聚合结果分页

GET /my-index-000001/_search
 {
      "size":0,
      "aggs" : {
          "group_account" : {
              "terms" : {
                "size": 2,
                "field" : "account",
                "order": {
                  "sum_gmv" : "desc" 
                }
              },
              "aggs": {
                  "sum_gmv": {
                      "sum": {"field": "bus_ep_gmv"}
                  }
              }
          }
      }
  }


8、聚合查询缓存说明

为了获得更快的响应,Elasticsearch 将频繁运行的聚合结果缓存到切分请求缓存中。

若要获取缓存结果,请对每次搜索使用相同的首选项字符串。

如果您不需要搜索命中、只返回聚合结果,请将大小设置为0,以避免填充缓存。


总结


本文主要是聚合查询进行了简单的介绍。

1、聚合查询主要使用场景:数据的统计分析。

2、聚合查询主要分为三个类别:


Metric 指标聚合

Bucket 桶聚合

Pipeline 管道聚合


3、聚合查询的简单使用示例。

目录
相关文章
|
XML Java 数据库
SpringBoot系列----注解详解
SpringBoot系列----注解详解
634 0
|
5月前
|
存储 机器学习/深度学习 C++
必知必会:大模型训练显存计算与优化详解
必知必会:大模型训练显存计算与优化详解
 必知必会:大模型训练显存计算与优化详解
|
8月前
|
人工智能 JavaScript Python
搞定这两个工具,让你玩转AI的效率翻倍!
环境配置不是技术,而是生产力!本文揭秘AI开发两大“护法”:uv(Python环境管理神器,秒装多版本、告别pip地狱)和nvm(Node.js版本自由切换),助你5分钟搞定环境,把时间留给创造,而非报错调试。
804 3
|
Java 数据库 微服务
微服务——SpringBoot使用归纳——Spring Boot事务配置管理——事务相关
本文介绍Spring Boot事务配置管理,阐述事务在企业应用开发中的重要性。事务确保数据操作可靠,任一异常均可回滚至初始状态,如转账、购票等场景需全流程执行成功才算完成。同时,事务管理在Spring Boot的service层广泛应用,但根据实际需求也可能存在无需事务的情况,例如独立数据插入操作。
405 0
|
9月前
|
关系型数据库 MySQL Docker
03-Docker下载加速 docker下载加速
本文介绍了两种Docker镜像下载加速方法:一是使用网易数帆、阿里云等镜像仓库直接拉取镜像,如通过`hub.c.163.com/library/mysql`下载MySQL;二是配置阿里云镜像加速器,修改`/etc/docker/daemon.json`文件添加加速地址,重启Docker服务后即可使用官方镜像命令快速拉取。此外,还介绍了如何为Docker配置HTTP/HTTPS代理,提升网络访问效率。
884 0
|
弹性计算 数据中心 UED
阿里云弹性公网IP线路类型【BGP(多线)_精品】是什么意思?
阿里云弹性公网IP的BGP(多线)_精品线路是一种优化海外回中国内地流量的公网线路,具备低时延、高稳定性优势,适用于中国内地用户访问海外部署的业务,如Web服务在中国香港等地域时,可显著提升访问体验。支持按量付费和包年包月模式,地域覆盖中国香港及多个亚太地区。
2354 1
|
关系型数据库 MySQL Unix
【MySQL用法】MySQL 中 datetime 和 timestamp 的区别与选择
【MySQL用法】MySQL 中 datetime 和 timestamp 的区别与选择
1679 0
elementUI使用Pagination分页组件增加自定义slot
本文介绍了如何在Element UI的Pagination分页组件中使用自定义slot。通过在`el-pagination`标签内的适当位置添加slot内容,可以在分页组件中插入自定义的HTML或组件。文章提供了一个示例代码,展示了如何添加两个自定义slot,并展示了最终效果。
2436 4
elementUI使用Pagination分页组件增加自定义slot
|
JSON fastjson 数据格式
利用fastjson对json转map的操作
String str = "{\"0\":\"zhangsan\",\"1\":\"lisi\",\"2\":\"wangwu\",\"3\":\"maliu\"}"; //第一种方式 Map maps = (Map)JSON.
13815 1
|
缓存 NoSQL 前端开发
《优化接口设计的思路》系列:第六篇—接口防抖(防重复提交)的一些方式
本文探讨了后端开发中的接口防抖策略,作者是一名有六年经验的Java开发者,分享了如何防止重复提交导致的问题。防抖主要用于避免用户误操作或网络波动引起的多次请求,作者提出理想防抖机制应具备正确性、响应速度、易集成和用户反馈。文章详细分析了哪些接口需要防抖(如用户输入、按钮点击、滚动加载)以及如何识别重复接口,提出了使用共享缓存和分布式锁两种实现方式,并展示了基于Redis的Java代码示例。作者通过注解实现请求锁,并提供了测试截图证明防抖效果。然而,实现完全幂等性还需要业务层面的补充措施。
1543 8