hive
制杖大师
爱生活爱运动
展开
-
hive中的存储方式
之前在进行存储空间统计的时候发现ORC格式可以节省很多存储空间,于是上网查了一些这个格式的相关信息。有兴趣详细了解的可以参考这个网站上的介绍https://www.iteblog.com/archives/1014.html Hive的存储格式主要有: 1.textfile Hive的默认存储格式 存储方式:行存储 磁盘开销大数据解析开销大 压缩的text文件 hive无法进行合并转载 2017-08-10 14:02:55 · 1416 阅读 · 0 评论 -
写给大数据开发初学者的话
先扯一下大数据的4V特征: 数据量大,TB->PB数据类型繁多,结构化、非结构化文本、日志、视频、图片、地理位置等;商业价值高,但是这种价值需要在海量数据之上,通过数据分析与机器学习更快速的挖掘出来;处理时效性高,海量数据的处理需求不再局限在离线计算当中。 现如今,正式为了应对大数据的这几个特点,开源的大数据框架越来越多,越来越强,先列举一些常见的: 文件存储:Hadoop转载 2017-08-10 15:31:33 · 260 阅读 · 0 评论