group_by_overflow_mode
throw: 예외를 발생시킵니다break: 쿼리 실행을 중지하고 부분 결과를 반환합니다any: Set에 포함된 키에 대해서는 집계를 계속하지만, 새로운 키는 Set에 추가하지 않습니다.
any 값을 사용하면 GROUP BY의 근사치를 계산할 수 있습니다. 이 근사의 품질은
데이터의 통계적 특성에 따라 달라집니다.
group_by_top_k_optimization_observation_rows
enable_group_by_top_k_optimization의 설정입니다. 각 집계 스트림이 입력 행의 10% 미만을 건너뛰고 용량보다 적은 수의 키를 제거한 가득 찬 top-K 힙을 고정하기 전에 관찰하는 행 수입니다. 힙이 고정되면 최적화가 비활성화된 것처럼 집계가 계속됩니다.
유효 윈도우는 힙의 예약 크기보다 최소 2배이므로, 평가 전에 힙이 채워질 기회가 항상 보장됩니다. 0은 이 고정을 비활성화합니다(경계 동률 집합이 힙보다 커지면 힙은 계속 고정됩니다).
ORDER BY 없이 사용하는 GROUP BY keys LIMIT K 쿼리에서는 고정이 항상 비활성화되므로 이 설정은 영향을 주지 않습니다. 이 형태의 계획에는 힙이 해시 테이블의 크기를 제한하는 동안에만 이점이 있는 합성 정렬이 포함되므로, 힙을 고정하면 최적화되지 않은 계획보다 느린 계획이 됩니다.
group_by_two_level_threshold
group_by_two_level_threshold_bytes
group_by_use_nulls
ROLLUP, CUBE, 또는 GROUPING SETS 지정자를 사용하면 일부 집계 키가 일부 결과 행을 생성하는 데 사용되지 않을 수 있습니다.
이러한 키의 컬럼은 이 설정에 따라 해당 행에서 기본값 또는 NULL로 채워집니다.
Possible values:
- 0 — 누락된 값을 생성할 때 집계 키 타입의 기본값을 사용합니다.
- 1 — ClickHouse는 SQL 표준에 정의된 방식과 동일하게
GROUP BY를 실행합니다. 집계 키의 타입은 널 허용으로 변환됩니다. 해당 집계 키의 컬럼은 이 키가 사용되지 않은 행에서 NULL로 채워집니다.