自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

迎难而上

热爱技术的IT人

  • 博客(3)
  • 收藏
  • 关注

原创 Hive_数据仓库_数据类型的选择

Hive 有很多的基础数据类型,在实际构建数仓的这么多数据类型,我们该如何选择呢?如果你的公司足够大,那么建议参照以下几条建议:浮点数建议:1) Hive 中Double类型需要慎用, Hive 中Double类型存在失真。例如: 原始数据是 10000, Hive 中10000 可能为10000.00012) 为了浮点数越界,或者失真的问题,建...

2020-03-31 22:25:33 916

原创 Hive_Hive内部表与外部表的选择

Hive 中有内部表 与 外部表 两种表。Hive 主要是用于数据仓库建设的。那么在数据仓库中,那我们该如何在两种表的类型中选择呢 ??下面是几条原则 : 1.在大部分场景下,两种表的应用没有太大的区别。 2.数据场景简单, 几乎都是在Hive中的流转, 可以优先选用内部表。 3.需要对数据内容和元数据进行紧凑的管理, 建...

2020-03-31 22:04:03 1842

原创 数据仓库_拉链表_拉链表实现思路

本篇文章,主要讲解1.什么是拉链表 以及 拉链表示例2.不同原始表情况下,拉链表如何构建。。。。。。

2020-03-13 20:44:36 4990 1

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除