《走进大数据之Hive入门》学习笔记(1)

Hive相关学习指南

Hive官网:http://hive.apache.org
Hive入门指南:http://wiki.apache.org/hadoop/Hive/GettingStarted
HQL查询语言指南:http://wiki.apache.org/hadoop/Hive/HiveQL
演示文稿:http://wiki.apache.org/hadoop/Hive/Presentations


第一章 概述

1-1 课程概述

Hive是基于Hadoop HDFS之上的数据仓库。
数据仓库:本质上就是一个数据库。但有别于我们通常意义上的数据库
Hive安装有3种方式。
Hadoop和Hive都是基于Linux操作系统构建的,所以要有熟悉掌握Linux下操作命令。

1-2 数据仓库简介

①数据仓库是一个面向主题的、集成的、不可更新的、随时间不变化的数据集合,它用于支持企业或组织的决策分析处理。
面向主题:主题是指用户使用数据仓库时关心的重点内容。
集成的:数据仓库可将不同类型数据库管理系统中的数据集成起来保存。
不可更新的:数据仓库一般只做数据查询,不做更新、删除等操作。
数据仓库的结构和建立过程:数据源(可能来源于业务数据库系统、文档资料和其他数据)——>数据存储及管理(ETL:抽取、转换、装载)——>数据仓库引擎(不同的服务器有不同的功能)——>前端展示(数据查询、数据报表、数据分析、各类应用)
OLTP应用:典型应用-银行转账
OLAP应用:典型应用-商品推荐系统
数据仓库的数据模型:星型模型和雪花模型

1-3 什么是Hive

①Hive是建立在Hadoop HDFS上的数据仓库基础架构。而传统的Oracle或MySQL数据仓库是直接建立在Oracle或MySQL数据库之上的。
②Hive可以用来进行数据提取、转化、加载(ETL)。
③Hive定义了简单的类似SQL查询语言,称为HQL它允许熟悉SQL的用户查询数据。
④Hive允许熟悉MapReduce开发者的开发自定义的mapper和reducer来处理內建mapper和reducer无法完成的复杂的分析工作。
⑤Hive的SQL解析引擎,它将SQL语句转移成M/R Job然后在Hadoop上执行。
⑥Hive的表其实就是HDFS的目录/文件。


第二章 Hive的体系结构

2-1 Hive的体系结构之元数据

Hive讲元数据存储在数据库中(metastore),支持mysql、de

  • 3
    点赞
  • 7
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
好的,我会尽力回答你关于大数据技术与应用的问题,以下是我的笔记: 1. 什么是大数据大数据是指数据量过大、处理复杂度高、价值密度低的数据。大数据具有“3V”特征:数据量大(Volume)、处理速度快(Velocity)、数据种类多(Variety)。 2. 大数据技术有哪些? 大数据技术主要分为存储、处理、分析三个方面。常用的大数据技术包括:Hadoop、Spark、Hive、HBase、Storm、Kafka等。 3. 大数据的应用场景有哪些? 大数据的应用场景非常广泛,包括但不限于以下几个方面: - 金融行业:风险控制、反欺诈、客户画像等; - 零售行业:销售预测、商品推荐、库存管理等; - 医疗行业:病人监测、疾病预测、数据分析等; - 交通行业:智能交通、交通拥堵预测、车辆管理等; - 教育行业:学生画像、教育资源管理、教学效果分析等。 4. 大数据的处理流程是什么? 大数据的处理流程可以分为以下几个步骤: - 数据采集:收集原始数据; - 数据存储:将采集到的数据存储到大数据平台中; - 数据清洗:对数据进行清洗,去除脏数据; - 数据处理:使用大数据技术对数据进行处理和分析; - 数据可视化:将处理后的结果以图形方式展现出来。 5. 大数据的挑战有哪些? 大数据的挑战主要包括以下几个方面: - 数据存储:海量数据的存储需要大量的存储空间; - 数据处理:海量数据的处理需要大量的计算资源; - 数据质量:大数据中存在大量的脏数据,需要进行数据清洗; - 数据安全:大数据中包含大量的敏感信息,需要保证数据安全; - 人才短缺:大数据技术需要专业的人才支持,但是目前人才供不应求。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值