1,含义
数据分析是指用适当的统计分析方法对收集来的大量数据进行分析,提取有用信息和形成结论而对数据加以详细研究和概括总结的过程。这一过程也是质量管理体系的支持过程。在实用中,数据分析可帮助人们作出判断,以便采取适当行动。
2,数据分析的过程
(1)数据收集:本地数据或者网络数据的采集与操作.
(2)数据处理:数据的规整,按照某种格式进行整合存储。
(3)数据分析:数据的科学计算,使用相关数据工具进行分析。
(4)数据展现:数据可视化,使用相关工具对分析出的数据进行展示。
3,数据分析的工具
(1)Python:Python在数据工程领域和机器学习领域有很多成熟的框架和算法库,完全可以只用Python就可以构建以数据为中心的应用程序。在数据工程领域和机器学习领域,Python非常非常流行。
(2)Scala:是一门函数式编程语言,熟练使用后开发效率较高,配合Spark适合大规模的数据分析和处理,Scala的运行环境是JVM。
(3)R/MATLAB:适合做学术性质的数据分析,在实际应用上需要额外转换为Python或Scala来实现,而且MATLAB(MathWorks公司出品的商业数学软件)是收费的。
(4)SAS:SAS(STATISTICAL ANALYSIS SYSTEM,简称S