ElasticSearch ‐ Aggregations - thought-corner/backend-roadmap GitHub Wiki

Metric Aggregations란?

  • 숫자 필드에 대해 sum, average, min, max, stats 같은 지표를 계산한다.
  • 여러 문서의 값이 하나의 숫자로 집계된다.
이름 계산
sum 합계
avg 평균
min 최솟값
max 최댓값
stats count, min, max, avg, sum을 한 번에
value_count 값이 있는 문서 수
cardinality 고유값 개수 (근사)
GET /products/_search
{
  "size": 0,
  "aggs": {
    "avg_price": {
      "avg": { "field": "price" }
    }
  }
}

Bucket Aggregations란?

  • bucket aggregation은 어떤 기준에 따라 문서를 버킷으로 묶는 기능이다.
  • 각 버킷은 공통된 특성을 공유하는 문서 그룹을 나타낸다. 특성은 필드 값, 값의 범위, 또는 더 복잡한 기준일 수 있다.

Bucket Aggregation의 종류

  • Terms Aggregation — 지정한 필드의 고유값을 기준으로 문서를 묶는다.GROUP BY 에 해당한다.
  • Range Aggregation미리 정의한 숫자 범위를 기준으로 문서를 버킷에 담는다.
  • Histogram Aggregation — range aggregation과 비슷하지만, 지정한 간격(interval)에 따라 균등한 버킷을 자동으로 만든다.
  • Date Histogram Aggregation일, 월, 년 같은 날짜 간격으로 문서를 묶는다.
  • Filter and Filters Aggregationfilter는 주어진 필터에 맞는 문서로 버킷 하나를 만들고, filters여러 필터를 두어 각각이 자기 버킷을 만든다.
  • Missing Aggregation — 지정한 필드가 없는 문서들로 버킷을 만든다.
  • Nested Aggregationnested object 안의 필드에 대해 집계를 수행한다.
  • Global Aggregation질의의 필터를 무시하고 인덱스의 모든 문서를 담는 버킷을 만든다.