大数据学习第三天

本文讲述了数据库(OLTP,事务处理,用于日常操作)与数据仓库(OLAP,分析处理,用于历史数据分析)之间的区别,包括设计目标、数据存储、冗余处理以及Hive与HDFS的关系。
摘要由CSDN通过智能技术生成

数仓和数据库:

数据库和数据仓库的区别实际讲的是OLTP和OLAP的区别

数据库是操作型处理,叫联机事务处理OLTP,也可以称面向用户交易的处理系统,它是针对具体业务在数据库联机的日常操作,通常进行增删改查操作。

数据仓库是分析型处理,叫联机分析处理OLAP,也可以称为面向专业分析人员进行数据分析,通常进行查询分析操作,一般针对某些主题的历史数据进行分析,支持管理决策。

数据库是面向事务的设计,数据仓库是面向主题设计的。

数据库一般存储业务数据,数据仓库存储的一般是历史数据。

数据库是为捕获数据而设计,数据仓库是为分析数据而设计。

数据库设计是尽量避免冗余,数据仓库在设计是有意引入冗余。

数据仓库架构可分为三层——源数据层(ODS)数据仓库层(DW)数据应用层(DA或APP)

创建数据库

create database if not exists myhive;
use myhive;

查看数据库详细信息


desc database myhive;

创建库的语法为

CREATE DATABASE [IF NOT EXISTS] db_name [LOCATION position];

删除库的语法为

DROP DATABASE db_name [CASCADE];

数据库和HDFS的关系

Hive的库在HDFS上就是一个以.db结尾的目录
默认存储在:/user/hive/warehouse内
可以通过LOCATION关键字在创建的时候指定存储目录

今天的学习,收货很多!

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值