Hive第五天——Hive函数(JSON解析函数)

本文介绍了在Hive中解析JSON数据的函数,包括get_json_object用于获取JSON字符串中特定字段的值,以及json_tuple用于一次性解析多个字段。通过实例展示了如何使用这些函数进行数据查询和统计分析。
摘要由CSDN通过智能技术生成

本文部分参考自:https://blog.csdn.net/qq_23897391/article/details/95091712


Hive第五天——Hive函数

自己的话:千里之行,始于足下。

每天都要保持前进,我势必要有强劲的实力,再跟明天的自己问好。

Json函数解析

在工作中我们会经常遇到JSON格式的日志数据,本文来详细介绍在Hive中解析JSON字符串的函数:

1.get_json_object

2.json_tuple

一、JSON格式

JSON(JavaScript Object Notation, JS 对象简谱) 是一种轻量级的数据交换格式,采用完全独立于编程语言的文本格式来存储和表示数据。

对象和数组是比较特殊且常用的两种类型。

对象:对象在 JS 中是使用花括号包裹 {} 起来的内容,数据结构为 {key1:value1, key2:value2, …} 的键值对结构。在面向对象的语言中,key 为对象的属性,value 为对应的值。键名可以使用整数和字符串来表示。值的类型可以是任意类型。

例如下面这样,其中user_id和platform是key,也就是我们要解析出来的列名,10000和ios是value,也就是我们要解析出来的数据内容:

{
  "user_id": "10000", "platform": "ios"}

数组:数组在 JS 中是方括号 [] 包裹起来的内容,数据结构为 [“java”, “javascript”, “vb”, …] 的索引结构。在 JS 中,数组是一种比较特殊的数据类型,它也可以像对象那样使用键值对,但还是索引使用得多。同样,值的类型可以是任意类型。


二、解析JSON字符串的一个字段 get_json_object

get_json_object(string json_string, string path)

1. 功能:

解析JSON的字符串json_string,返回path指定的内容。如果输入的JSON字符串无效,那么返回NULL。path的具体语法如下:

  • $ : Root object(根对象)
  • . : Child operator(子连接符)
  • [ ]: Subscript operator for array(数组下标操作符)
  • *: Wildcard for [](数组中使用的通配符)
2.举例:

求电影top10
将数据rating.json上传到hdp03的/home下
数据如下:

在这里插入图片描述

(1)在hive中先创建一张表,将一行的json看做一个字段:
hive> create table t_rate_json(line string) row format delimited;
(2)导入数据:
hive> load data local inpath '/home/rating.json' into table t_rate_json;
(3)查询:
select * from t_rate_json limit 10;

在这里插入图片描述

(4)创建一张表,存储解析后的数据:
hive> create table t_rate(movie string
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值