📄️ any_value
在包含 GROUP BY 的聚合查询中,该函数用于从每个聚合分组中随机选择一行返回。
📄️ approx_count_distinct
返回类似于 COUNT(DISTINCT col) 结果的近似值。
📄️ approx_top_k
返回表达式 expr 中最常出现的 k 个项目以及每个项目出现的近似次数。
📄️ avg
用于返回选中字段的平均值。
📄️ bitmap
这里通过一个简单的示例来介绍 Bitmap 中的几个聚合函数的用法,具体的函数定义以及更多 Bitmap 函数请参考 bitmap-functions。
📄️ bool_or
如果 expr 的某一行计算结果为 true,则返回 true。否则,返回 false。boolor_agg 是此函数的别名。
📄️ corr
返回两个随机变量的皮尔逊相关系数(correlation coefficient)。该函数从 2.5.10 版本开始支持,也可用作窗口函数。
📄️ count
计算总行数。
📄️ count_if
计算满足指定条件(即条件表达试的结果为 true)的记录数。
📄️ covar_pop
返回两个随机变量的总体协方差。该函数从 2.5.10 版本开始支持,也可用作窗口函数。
📄️ covar_samp
返回两个随机变量的样本协方差。该函数从 2.5.10 版本开始支持,也可用作窗口函数。
📄️ ds_hll_accumulate
将值累积到 HyperLogLog 草图中,并返回序列化的草图作为 VARBINARY,用于近似去重计数。属于 DataSketches HLL 函数族。
📄️ ds_hll_combine
将多个序列化的 DataSketches HyperLogLog (HLL) 草图合并为单个序列化草图,用于近似去重计数。
📄️ ds_hll_count_distinct
使用 DataSketches HyperLogLog 返回近似去重计数。与 APPROX_COUNT_DISTINCT 类似,但精度更高。
📄️ ds_hll_estimate
从序列化的 DataSketches HyperLogLog (HLL) 草图估算近似去重计数。
📄️ ds_theta_count_distinct
使用 DataSketches Theta 草图返回近似去重计数。比 COUNT DISTINCT 更快,处理高基数列时内存占用更少。
📄️ group_concat
将分组中的多个非 NULL 值连接成一个字符串,参数 sep 为字符串之间的连接符,该参数可选,默认为 ,。该函数在连接时会忽略 NULL 值。
📄️ grouping
判断一个列是否为聚合列,如果是聚合列则返回 0,否则返回 1。
📄️ grouping_id
用于区分相同分组标准的分组统计结果。
📄️ hll_raw_agg
此函数为聚合函数,用于聚合 HLL 类型的字段,返回的还是 HLL 类型。