SQL中的分析函数

分析函数

1、聚合分析函数

SQL Aggregate 函数计算从列中取得的值,返回一个单一的值。

  • avg():计算一个组和数据窗口内表达式的平均值
  • sum():计算组中表达式的累积和
  • max():在一个组中的数据窗口中查找表达式的最大值
  • min():在一个组中的数据窗口中查找表达式的最小值
  • count(): 对一组内的事务进行累积计数

2、排名分析函数

  • row_number()按照值排序时产生一个自增编号,不会重复(如:1、2、3、4、5、6)
  • rank() 按照值排序时产生一个自增编号,值相等时会重复,会产生空位(如:1、2、3、3、3、6)
  • dense_rank() 按照值排序时产生一个自增编号,值相等时会重复,不会产生空位(如:1、2、3、3、3、4)
  • FIRST() :返回第一个记录的值
  • LAST() : 返回最后一个记录的值
  • FIRST_VALUE : 从DENSE_RANK返回的集合中取出排在最前面的一个值的行
  • LAST_VALUE : 从DENSE_RANK返回的集合中取出排在最后面的一个值的行

3、数学分析函数

  • ntile(n) 把有序分区中的行分发到指定数据的组中,各个组有编号,编号从1开始,对于每一行,ntile返回此行所属的组的编号
  • STDDEV :计算当前行关于组的标准偏离
  • STDDEV_POP:该函数计算总体标准偏离,并返回总体变量的平方根
  • STDDEV_SAMP:该函数计算累积样本标准偏离,并返回总体变量的平方根
  • VAR_POP :该函数返回非空集合的总体变量(忽略null)
  • VAR_SAMP :该函数返回非空集合的样本变量(忽略null)
  • VARIANCE :如果表达式中行数为1,则返回0,如果表达式中行数大于1,则返回VAR_SAMP
  • COVAR_POP :返回一对表达式的总体协方差
  • COVAR_SAMP :返回一对表达式的样本协方差
  • CORR :返回一对表达式的相关系数
  • CUME_DIST :计算一行在组中的相对位置
  • NTILE :将一个组分为"表达式"的散列表示(类于Hive的分桶原理)
  • PERCENT_RANK :和CUME_DIST(累积分配)函数类似
  • PERCENTILE_DISC :返回一个与输入的分布百分比值相对应的数据值
  • PERCENTILE_CONT :返回一个与输入的分布百分比值相对应的数据
  • RATIO_TO_REPORT :该函数计算expression/(sum(expression))的值,它给出相对于总数的百分比
  • REGR_ (Linear Regression) Functions :这些线性回归函数适合最小二乘法回归线,有9个不同的回归函数可使用

4、行比较的分析函数

  • lag(列名,往前第几行的数据,[行数为null时的默认值,不指定为null]),可以计算用户上次购买时间,或者用户下次购买时间。
  • lead(列名,往后第几行的数据,[行数为null时的默认值,不指定为null])
  • 1
    点赞
  • 14
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值