1、什么是大数据
【大数据】
- 是指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的数据集合,是需要新处理模式才能具有更强的决策力、洞察发现力和流程优化能力的海量、高增长率和多样化的信息资产。
- 是指一种规模大到在获取、存储、管理、分析方面大大超出了传统数据库软件工具能力范围的数据集合,具有海量的数据规模、快速的数据流转、多样的数据类型和价值密度低四大特征。
- 数据的存储单位
最小的基本单位是bit
1 Byte =8 bit
1 KB = 1,024 Bytes = 8192 bit
KB -> MB -> GB -> TB -> PB -> EB -> ZB -> YB -> BB -> NB -> DB
进率1024
传统数据与大数据的对比
大数据的特点
数据集主要特点:
- Volume(大量): 数据量巨大,从TB到PB级别。
- Velocity(高速): 数据量在持续增加(两位数的年增长率)。
- Variety(多样): 数据类型复杂,超过80%的数据是非结构化的。
- Value(低密度高价值): 低成本创造高价值。
传统数据下服务器系统安装
在传统数据背景下,服务器系统安装中,系统硬盘、数据硬盘完全隔离。
大数据下服务器系统安装
在大数据背景下,服务器系统安装中,系统硬盘、数据硬盘完全隔离。数据硬盘必须独立挂载,每个硬盘挂载到系统的一个独立的目录下。