大数据导论
1、概念
大数据时代: 万物皆数据 数据概念: 人类的行为及产生的事件的一种记录称之为数据 数据价值: 对数据的内容进行深入分析,可以更好的帮助了解事和物在现实世界的运行规律
2、大数据诞生
大数据的诞生: 跟随着互联网的发展的,当全球互联网逐步建成(2000年左右),各大企业或政府单位拥有了海量的数据亟待处理。基于这个前提逐步诞生了以分布式的形式(即多台服务器集群)完成海量数据处理的处理方式,并逐步发展成现代大数据体系。 分布式: 多台服务器互相配合协同处理同一个事情 Apache Hadoop对大数据体系的意义: 第一款获得业界普遍认可的企业级开源分布式解决方案, 一定程度上催生出了众多的大数据体系技术栈,从Hadoop开源开始(2008年左右)大数据开始蓬勃发展
3、大数据概述
什么是大数据? 狭义上: 对海量数据进行处理的软件技术体系 广义上: 数字化、信息化时代的基础支撑,以数据为生活赋能 狭义和广义联系: 学习狭义上的大数据软件技术体系,在工作中为广义上的数字化、信息化时代,添砖加瓦 大数据解决了什么问题? 问题1: 海量数据的存储 问题2: 海量数据的计算 问题3: 海量数据的传输 大数据的核心工作? 存储: 利用各类大数据技术栈,妥善保存海量待处理数据 计算: 利用各类大数据技术栈,完成海量数据的价值挖掘 传输: 利用各类大数据技术栈,协助各个环节的数据传输
4、大数据特征
大数据特征简述: 5v(大多值快信)
大: 数据量大,1TB=1024GB&#x