带你读《Elastic Stack 实战手册》之40:——3.4.2.21.Aggregations(10)

简介: 带你读《Elastic Stack 实战手册》之40:——3.4.2.21.Aggregations(10)

《Elastic Stack 实战手册》——三、产品能力——3.4.入门篇——3.4.2.Elasticsearch基础应用——3.4.2.21.Aggregations(9) https://developer.aliyun.com/article/1229232


4、直方图聚合 histogram 和日期直方图聚合 date_histogram

 

1)基础用法

直方图聚合通常用来查看文档的分布情况,比如对产品价格进行间隔为1000进行分组聚合:


GET order/_search
{
  "aggs": {
    "histogram_test": {        
     "histogram": {         //聚合类型
       "field": "price",
       "interval": 1000        //分组间隔
     }     
    }
  }
}
结果:
"aggregations" : {
    "histogram_test" : {
      "buckets" : [
        {
          "key" : 7000.0,
          "doc_count" : 2
        },
        {
          "key" : 8000.0,
          "doc_count" : 2
        },
        {
          "key" : 9000.0,
          "doc_count" : 2
        }
      ]
    }
  }
}

通过结果可以看到价格为7000、8000、9000的文档数量都是2个。如果聚合结果很多,而我们又更关心数量多的文档情况,那么此时可以通过设置 min_doc_count(最小文档计数)参数来限制文档数小于多少的不展示。

 

一般来说,文档的分桶结果会基于数据本身。例如你的目的是要0-500的价格分桶,而数据只有100以上的,那么返回结果不存在100以下的桶。此时如果有此类需求,可以通过extended_bounds设置桶的最大值和最小值,强制返回聚合数量为0的结果。可以通过这种order更改计算结果的排序规则,_count 代表按照 doc_count 的值进行排序,默认为 desc; _key 代表按照 key 的字母顺序进行排序。

 

Date histogram 日期直方图的用法与 histogram 基本一致,只不过 interval 间隔上支持了日期的表达式。支持的表达式为: `year`, `quarter`, `month`, `week`, `day`, `hour`, `minute`, `second`。也可以使用固定间隔,支持表达式为:milliseconds (ms)、seconds (s)、minutes (m)、hours (h)、days (d)。返回结果支持使用 "format":"yyyy-MM-dd" 进行格式化。

 

5、范围聚合 range、时间范围聚合 date_range、ip范围聚合ip_range

 

1)基础用法

 

范围聚合通常用来统计用户自定义范围内的文档数量。通过 from 和 to 定义范围边界,结果包含 from 值但排除 to 值。

 

例如对产品价格7000-8000做聚合,可以看到结果命中了2个文档。


GET order/_search
{
  "aggs": {
    "range_test": {
    "range": {
      "field": "price",
      "ranges": [
    870         >   三、产品能力
        {
          "from": 7000,
          "to": 8000
        }
      ]
    }     
    }
  }
}
聚合结果:
"aggregations" : {
    "range_test" : {
      "buckets" : [
        {
          "key" : "7000.0-8000.0",
          "from" : 7000.0,
          "to" : 8000.0,
          "doc_count" : 2
        }
      ]
    }
  }

Elasticsearch 为了满足各类用户的需求,也提供了时间范围聚合 date_range、ip 范围聚合

ip_range 分别支持对日期和 ipv4 类型字段的聚合统计。

 

《Elastic Stack 实战手册》——三、产品能力——3.4.入门篇——3.4.2.Elasticsearch基础应用——3.4.2.21.Aggregations(11) https://developer.aliyun.com/article/1229229

相关实践学习
以电商场景为例搭建AI语义搜索应用
本实验旨在通过阿里云Elasticsearch结合阿里云搜索开发工作台AI模型服务,构建一个高效、精准的语义搜索系统,模拟电商场景,深入理解AI搜索技术原理并掌握其实现过程。
ElasticSearch 最新快速入门教程
本课程由千锋教育提供。全文搜索的需求非常大。而开源的解决办法Elasricsearch(Elastic)就是一个非常好的工具。目前是全文搜索引擎的首选。本系列教程由浅入深讲解了在CentOS7系统下如何搭建ElasticSearch,如何使用Kibana实现各种方式的搜索并详细分析了搜索的原理,最后讲解了在Java应用中如何集成ElasticSearch并实现搜索。  
相关文章
|
7天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
6953 9
|
5天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
1400 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
6天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
870 5
|
19天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
千问办公是阿里云推出的一站式AI办公平台,主打"不止于对话,更注重交付",依托通义千问旗舰大模型,用户一句话即可完成数据分析、PPT生成、视频剪辑等复杂任务,直接输出可用成果。产品深度打通钉钉生态与企业OA,覆盖桌面端、网页端,提供企业标准版198元/人/月等多档订阅方案,新用户注册即赠2000积分,适配工程师、HR、财务等多职业办公场景,成为能动手干活的"全能AI同事"。
3440 10
|
14天前
|
缓存 IDE Java
【保姆级】Android Studio下载、安装和汉化教程(2026最新)
Android Studio 是 Google 官方推出的免费 Android 应用开发集成环境,基于 IntelliJ IDEA,内置模拟器、调试器、性能分析及 Compose 界面工具,功能全面,文档丰富,是安卓开发首选工具。(239字)
1517 1
|
18天前
|
IDE 开发工具
Qoder 上线 Sonus 模型,Computer Use 能力全面增强
Qoder国际版上线全新内置大模型Sonus(/ˈsoʊnəs/),全球领先,专精超长任务执行与电脑操作(Computer Use)。配合Qoder桌面端0.2.3版本,可自主完成编程、金融建模、科研及表格制作等复杂工作。现全面支持Qoder全系产品,效率提升3.2倍。
1898 9
Qoder 上线 Sonus 模型,Computer Use 能力全面增强

热门文章

最新文章