数据仓库---Hive

Hive是一个基于Hadoop的数据仓库工具,用于大规模数据存储和分析。它弥补了传统数据仓库在处理海量数据和非结构化数据时的不足,提供了一种类似SQL的查询语言HiveQL。Hive通过批处理方式处理数据,利用HDFS存储数据,MapReduce进行计算。与传统数据库相比,Hive不支持实时查询和数据更新,但具备良好的水平扩展性,适合大数据批处理分析。
摘要由CSDN通过智能技术生成

1. 数据仓库

 1.1 概念

        一个非常规范标准的定义是:数据仓库是一个面向主题的、集成的、相对稳定的、反应历史变化的数据集合,用于支持管理决策。

1.2 根本目的

        数据仓库的根本目的是为了支持企业内部的商业分析和决策,也即企业相关的经营管理可以基于数据仓库的分析结果做出相关的经营决策。

1.3 典型的数据仓库体系结构

        数据仓库的数据都来自于数据源,数据源中的数据需要经过抽取、转换、加载(ETL)的一个过程加载到数据仓库中,加载到数据仓库当中以后可以通过OLAP服务器和数据挖掘引擎为上层应用提供服务,可以对外提供数据挖掘等各种类型的应用。

1.4 数据仓库和传统数据库的比较

数据仓库和传统的数据库有非常本质的区别:

(1)数据仓库的数据是非常稳定的,它不会频繁发生变化,甚至根本就不发生变化。



  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值