R数据挖掘技术-基于R语言的数据挖掘和统计分析技术

培训要点

互联网点击数据、传感数据、日志文件、具有丰富地理空间信息的移动数据和涉及网络的各类评论,成为了海量信息的多种形式。当数据以成百上千TB不断增长的时候,我们在内部交易系统的历史信息之外,需要一种基于大数据分析的决策模型和技术支持。

目前对大数据的分析工具,有Hadoop/Yarn上基于Java语言的Mahout,有Spark上基于Scala的MLlib,但这些工具都由于比较年轻以及侧重于计算背景的分布式,与传统的行业应用联系还不是太紧密,在传统行业中应用,至少目前效果和影响还有待提高。

R语言是一个数据分析和图形显示的程序设计环境,广泛用于统计分析、绘图的语言和操作。同时R也是一个用于统计计算和统计制图的优秀工具,也是GNU的一个自由、免费、源代码开放的软件。R包括一套完整的数据处理、计算和制图软件系统。其功能包括:数据存储和处理系统;数组运算工具(其向量、矩阵运算方面功能尤其强大);完整连贯的统计分析工具;优秀的统计制图功能;简便而强大的编程语言:可操纵数据的输入和输入,可实现分支、循环,用户可自定义功能。

事实上,R是目前广大企业通用的数据挖掘与统计分析工具,为此Spark等大数据平台从2014年就开始在SparkR等技术中,将R引入到大数据统计分析中,未来形成以R语言为代表的SparkR, 以类SQL为代表的SparkQL,以及Hive on Tez三足鼎立的大数据统计分析工具和平台。

本课程从R语言数据挖掘和统计分析实战的角度,结合理论和实践,全方位地介绍R这一高性能数据分析工具的开发技巧。本课程涉及的主题包括:本培训将介绍基于R语言进行数据处理、数据探索的基本方法,利用R语言实现模型选择、Logistic

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值