hive row_number等窗口分析函数

一、排序&去重分析

row_number() over(partititon by col1 order by col2) as rn

结果：1,2,3,4

rank() over(partititon by col1 order by col2) as rk

结果：1，2，2，4，5

dense_rank() over(partititon by col1 order by col2) as ds_rk

结果：1，2，2，3，4

select

        order_id,

        departure_date,

        row_number() over(partition by order_id order by departure_date) as rn,  -- 直排

        rank() over(partition by order_id order by departure_date) as rk,        -- 并列的，下一个数字会跳过

        dense_rank() over(partition by order_id order by departure_date) as d_rk -- 并列的，下一个数据不会跳过

  from ord_test

 where order_id=410341346

;

运行结果：

二、跨行获取　　

lag(col1,n,DEFAULT) over(partition by col1 order by col2) as up
用于统计窗口内往上第n行值,第一个参数为列名，第二个参数为往上第n行（可选，默认为1），第三个参数为默认值（当往上第n行为NULL时候，取默认值，如不指定，则为NULL）

lead(col1,n,DEFAULT) over(partition by col1 order by col2) as down
用于统计窗口内往下第n行值,第一个参数为列名，第二个参数为往下第n行（可选，默认为1），第三个参数为默认值（当往下第n行为NULL时候，取默认值，如不指定，则为NULL）

first_value() over(partition by col1 order by col2) as fv
取分组内排序后，截止到当前行，第一个值

last_value() over(partition by col1 order by col2) as lv
取分组内排序后，截止到当前行，第一个值

select

       order_id,

       departure_date,

       first_value(departure_date) over(partition by order_id order by add_time)as fv,  -- 取分组内第一条

       last_value(departure_date) over(partition by order_id order by add_time)as lv    -- 取分组内最后一条

  from ord_test

 where order_id=410341346

;

select

       order_id,

       departure_date,

       lead(departure_date,1) over(partition by order_id order by departure_date)as down_1, -- 向下取一级

       lag(departure_date,1) over(partition by order_id order by departure_date)as up_1     -- 向上取一级

  from ord_test

 where order_id=410341346

;

结果截图：

hive row_number等窗口分析函数的更多相关文章

Hive—简单窗口分析函数
hive 窗口分析函数 : jdbc:hive2:> select * from t_access; +----------------+---------------------------- ...
Hive 窗口分析函数
1.窗口函数 1.LAG(col,n,DEFAULT) 用于统计窗口内往上第n行值第一个参数为列名,第二个参数为往上第n行(可选,默认为1),第三个参数为默认值(当往上第n行为NULL时候,取默认值 ...
hive中窗口分析函数
分组统计 1. groups sets(field1,field2,field3, (field1,field2)) 样例如下: select dt,tenantCode,nvl(platform,' ...
1.hive开窗函数，分析函数
http://yugouai.iteye.com/blog/1908121 分析函数用于计算基于组的某种聚合值,它和聚合函数的不同之处是:对于每个组返回多行,而聚合函数对于每个组只返回一行.开窗函数指 ...
Hive row_number() 等用法
1.row_number() over()排序功能: (1) row_number() over()分组排序功能: 在使用 row_number() over()函数时候,over()里头的分组以及排 ...
Hive ROW_NUMBER,RANK(),DENSE_RANK()
准备数据浙江,杭州,300 浙江,宁波,150 浙江,温州,200 浙江,嘉兴,100 江苏,南京,270 江苏,苏州,299 江苏,某市,200 江苏,某某市,100 创建表 CREATE t ...
HIVE ROW_NUMBER()函数去重
SELECT * FROM( SELECT *,ROW_NUMBER() OVER(PARTITION BY a.claimno ORDER BY b.financiancedate DESC) n ...
Hive数据分析——Spark是一种基于rdd（弹性数据集）的内存分布式并行处理框架，比于Hadoop将大量的中间结果写入HDFS，Spark避免了中间结果的持久化
转自:http://blog.csdn.net/wh_springer/article/details/51842496 近十年来,随着Hadoop生态系统的不断完善,Hadoop早已成为大数据事实上 ...
Hive简记
在大数据工作中难免遇到数据仓库(OLAP)架构,以及通过Hive SQL简化分布式计算的场景.所以想通过这篇博客对Hive使用有一个大致总结,希望道友多多指教! 摘要: 1.Hive安装 2.Hive ...

随机推荐

SELECT INTO 和 INSERT INTO SELECT
做数据库开发的过程中难免会遇到有表数据备份的,而SELECT INTO……和INSERT INTO SELECT…… 这两种语句就是用来进行表数据复制,下面简单的介绍下: 1.INSERT INTO ...
HOJ Recoup Traveling Expenses(最长递减子序列变形)
A person wants to travel around some places. The welfare in his company can cover some of the airfar ...
利用Qt开发跨平台APP（二）（iOS，使用Qt5.9，很详细，有截图）
本文将手把手教你如何使用Qt编译出iOS应用程序. Qt是一个优秀的跨平台开发工具.我们利用Qt可以很方便地将一次编写的应用,多次编译到不同平台上,如Windows.Linux.MAC.Android ...
存储5——逻辑卷管理LVM
1. LVM概念 LVM是 Logical Volume Manager(逻辑卷管理)的简写,它由Heinz Mauelshagen在Linux 2.4内核上实现.LVM将一个或多个硬盘的分区在逻辑上 ...
python 面向对象· self 讲解
self就是参数以形参形式 5.self是什么鬼? self是一个python自动会给传值的参数那个对象执行方法,self就是谁. obj1.fetch('selec...') self=obj1 ...
006-spring cache-缓存实现-01-原生实现
一.原生实现 1.1.pom  <dependency> <groupId>org.springframework.boot</grou ...
tools-eclipse-004-UML图安装
git:https://github.com/takezoe/amateras-modeler 下载:http://sourceforge.jp/projects/amateras/downloads ...
[RGEOS]数学基础
1.向量Vector3d using System; namespace RGeos.Geometry { /// <summary> /// 3D向量类 /// </summary ...
[css]网站骨架布局作业
实现效果图: 代码实现第一次写的时候不知道如何下手, 后来摸清规律了,由大到小. 由全局到局部第一次还遇到区块命名问题, 和哪个该怎么划分问题第一次还遇到由于划分不规整,所以有些代码没达到预期的 ...
java static成员变量方法和非static成员变量方法的区别
这里的普通方法和成员变量是指,非静态方法和非静态成员变量首先static是静态的意思,是修饰符,可以被用来修饰变量或者方法. static成员变量有全局变量的作用非static成员变量则 ...

hive row_number等窗口分析函数

hive row_number等窗口分析函数的更多相关文章

随机推荐

热门专题