数仓和数据库:
数据库和数据仓库的区别实际讲的是OLTP和OLAP的区别
数据库是操作型处理,叫联机事务处理OLTP,也可以称面向用户交易的处理系统,它是针对具体业务在数据库联机的日常操作,通常进行增删改查操作。
数据仓库是分析型处理,叫联机分析处理OLAP,也可以称为面向专业分析人员进行数据分析,通常进行查询分析操作,一般针对某些主题的历史数据进行分析,支持管理决策。
数据库是面向事务的设计,数据仓库是面向主题设计的。
数据库一般存储业务数据,数据仓库存储的一般是历史数据。
数据库是为捕获数据而设计,数据仓库是为分析数据而设计。
数据库设计是尽量避免冗余,数据仓库在设计是有意引入冗余。
数据仓库架构可分为三层——源数据层(ODS)、数据仓库层(DW)、数据应用层(DA或APP)
创建数据库
create database if not exists myhive;
use myhive;
查看数据库详细信息
desc database myhive;
创建库的语法为
CREATE DATABASE [IF NOT EXISTS] db_name [LOCATION position];
删除库的语法为
DROP DATABASE db_name [CASCADE];
数据库和HDFS的关系
Hive的库在HDFS上就是一个以.db结尾的目录
默认存储在:/user/hive/warehouse内
可以通过LOCATION关键字在创建的时候指定存储目录
今天的学习,收货很多!