015_[小插曲]看黄老师《炼数成金Hadoop应用开发实战案例》笔记

1、大数据金字塔结构

   Data Source-->Data Warehouses/Data Marts-->data exploration-->Data Mining-->Data Presentations-->Making Decisions

2、从业职位
   业务人员、ETL工程师、数据仓库工程师(及时需求)、数据分析师、数据展现设计师、
   IT支持人员:运维。程序员、生产线数据管理员

3、数据分析:统计方法,有目的 地对收集到的数据进行处理。
   数据挖掘:查找隐藏在数据中的信息的技术、应用算法从大数据集提取知识、隐性关联
   商业智能:Business Intelligece简称BI。
    BI=数据仓库(存储层)+数据分析与数据挖掘(分析层)+报表(展示层)

4、数据分析常用的算法和软件
   回归、时间序列分析、分类器(学习集)、聚类(聚合)、频繁模式挖掘

5、常用的传统数据分析工具排行
   R、SAS、Weka、STATISTICA、Matlab……
   这些都是实验室工具,当建模结束后,就不要他们,后面的预测工作就可以使用java、php、oracle等来做。
   后者是生产环境里面实现模型的工具。
   将建模的过程与实现建模生产的过程区分开来。

6、数据分析的层次
   第一层&#

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值