自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(2)
  • 资源 (1)
  • 收藏
  • 关注

原创 Zeppelin与Linkis、Scriptis的实践对比

最近部门打算构建个小规模的数据平台, 基础平台部分就用Hadoop、hive、spark这套,相对比较成熟了,交互分析这块儿的交给我来做个poc。刚好上周听说微众银行要开源他们的数据平台,跟老大请了半天假 过去听了下,貌似挺牛逼等。这里有宣传感兴趣的可以看下https://fintech.webank.com/wedatasphere?from=groupmessage&is...

2019-08-02 11:55:15 8718 3

原创 centos 6.3 64位编译 hadoop2.6.0 (2.5.2 2.5.1 均可行)

centos 6.3 64位编译 hadoop2.6.0 (2.5.2 2.5.1 均可行)本方法 亲测可行 历时三天 期间遇到各种奇葩问题,目测是编译过程中某些文件没有下载下来的原因 如果 有人需要编译好的 文件 联系[email protected](文件大于60M 不让上传 不好意思哈)

2014-12-21 13:04:42 551

RHadoop云计算服务器集群架构指南

RHadoop是运行R语言的Hadoop分布式计算平台的简称。要认识Rhadoop首先我们分别来认识R语言和Hadoop。 Hadoop已经成名好多年了,它是Apache软件基金会旗下的一个JAVA开源分布式计算平台,现已被各大互联网企业(包括Yahoo和Facebook等)用于大规模数据分布式存储与分布式计算。近年来随着云计算、大数据处理、数据挖掘等概念和应用越来越火,Hadoop更是名声大噪,各大企业对熟悉Hadoop体系架构和性能优化的人才需求也相当旺盛,人才缺口也相对加大。 R语言可能对大多数人来说比较陌生,但是做数理统计、数据分析的人不会不知道R。R是一门主要运用于统计分析与绘图的编程语言和操作工具。和Matlab类似,R是一门高级脚本化编程语言,直接在命令行输入指令即可运行,无需编译链接。它可以进行高效的向量化运算,效率远高于传统的循环运算。另外,R是开源的,有大批杰出的工程师和程序员为R开发了许多好用的函数库和图形化工具,尤其在数理统计方面有大量成熟的开源的程序包。所以R是做数据挖掘、数据分析的廉价高效的方案。 所以如果让能R运行在Hadoop平台上可以说是如虎添翼,可以让数据分析人员,即能用到R丰富的程序包,又能借助Hadoop分布式运算、分布式存储的优势做海量数据的处理。 现在,这个如果已经可以成为结果

2014-09-11

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除