ds_hll_count_distinct
返回聚合函数的近似值,结果类似于 COUNT(DISTINCT col)。相似函数为 APPROX_COUNT_DISTINCT(expr)。
相较于 COUNT DISTINCT 速度更快,并且使用固定大小的内存,因此基于高基数列使用时内存占用更少。
相较于 APPROX_COUNT_DISTINCT(expr) 速度更慢,但由于 Apache Datasketches 的优势,导致其精度更高。更多信息,参考 HyperLogLog Sketches。
语法
ds_hll_count_distinct(expr, [log_k], [tgt_type])
log_k:必须为整数。范围:[4, 21]。默认值:17。tgt_type:有效值为HLL_4、HLL_6(默认)以及HLL_8。