数仓建模—表设计规范
前面我们介绍了一些数仓的设计规范,主要围绕着数仓整体的设计以及维度建模来的,你可以参考:
我们知道数仓本质上是一堆表的集合,所以我们今天就来看一些关于表本身的一些设计问题
表的概述
表本身其实就是一组文件的集合,只不过我们赋予了它结构的概念,最终演化成了数据的组织方式。在整个数仓中从数据源到数据集成再到数据开发以及到最后的数据应用,我们都是通过表来完成的,也就是说我们的整个过程都是围绕着表来的。
我们大致有下面几类表
表(Table)是Hive的数据存储单元。它在逻辑上是由行和列组成的二维结构,每行代表一条记录,每列表示相同数据类型的一个字段。一条记录可以包含一个或多个列