大数据基础与应用笔记(第一周 初识大数据)


内容来自中国大学MOOC,北京理工大学,大数据基础与应用课程,侵删。
如有错误,烦请指出。


大数据基础与应用笔记 第一周 初识大数据

一、大数据分析流程

1 - 1 - 处理平台

1. 数据获取

  • 获取数据

2. 数据清洗

  • 补充部分数据缺失的属性值
  • 统一数据格式、编码和度量
  • 检测和删除异常数据
  • 研究表明数据准备大概占 80% 的工作量

3. 数据管理

  • 对数据进行分类、编码、存储、索引和查询
  • 经历了文件管理、数据库、数据仓库、大数据时代新型数据管理系统
  • 向着低成本、高效率的存储查询技术方向发展
  • 数据安全与隐私保护受到广泛关注

4. 数据分析

  • 统计查询
  • 从数据中挖掘特定的模式
  • 预测分析

5. 数据呈现

  • 建立从输入数据到符合认知规律的可视化表征
  • 利用可视化图形呈现数据中隐藏的信息和规律
  • 能够创建可交互的视图
  • 具体包括高维数据可视化、网络和层次数据可视化、时空数据可视化、文本数据可视化等

二、智能医疗大数据

1. 大数据在健康医疗行业中应用价值

2.1 - 应用价值

2. 健康医疗大数据平台

2.2 - 1 - 平台架构2.2 - 2 - 平台架构2.2 - 3 - 平台架构2.2 - 4 - 平台架构

3. 健康医疗大数据应用

2.3 - 1 - 应用2.3 - 2 -场景示例2.3 -  - 互联网医院应用场景

4. 健康大数据发展趋势及智能医疗

2.4 - 发展趋势2.4 - 人工智能赋能医疗领域

三、金融科技与大数据风控

3 - 1 - 方案概述3 - 2 - 金融云3 - 3 - 数据仓库3 - 4 - 业务流3 - 5 - 架构图3 - 6 - 系统逻辑架构3 - 7 - 实时风控主要数据流向3 - 8 - 实时决策平台扩招性3 - 9 - 业务规则开发及测试3 - 10 - 风控规则管理3 - 11 - 风险监测
典型案例:风控
3 - 12 - 风控13 - 13 - 风控2
典型案例:证券
3 - 14 - 证券

四、政务最多跑一次

4 - 1 - 全景 offerings4 - 2 - 大数据共享交换平台架构4 - 3 - 大数据共享交换平台技术架构4 - 4 - 特性14 - 5 - 特性24 - 6 - 特性34 - 7  -特性44 - 8 - 特性54 - 9 - 全国信用信息共享交换大数据云平台4 - 10 - 宜春4 - 11 - 西安4 - 12 - 嘉兴

好的,我会尽力回答你关于大数据技术与应用的问题,以下是我的笔记: 1. 什么是大数据大数据是指数据量过大、处理复杂度高、价值密度低的数据。大数据具有“3V”特征:数据量大(Volume)、处理速度快(Velocity)、数据种类多(Variety)。 2. 大数据技术有哪些? 大数据技术主要分为存储、处理、分析三个方面。常用的大数据技术包括:Hadoop、Spark、Hive、HBase、Storm、Kafka等。 3. 大数据应用场景有哪些? 大数据应用场景非常广泛,包括但不限于以下几个方面: - 金融行业:风险控制、反欺诈、客户画像等; - 零售行业:销售预测、商品推荐、库存管理等; - 医疗行业:病人监测、疾病预测、数据分析等; - 交通行业:智能交通、交通拥堵预测、车辆管理等; - 教育行业:学生画像、教育资源管理、教学效果分析等。 4. 大数据的处理流程是什么? 大数据的处理流程可以分为以下几个步骤: - 数据采集:收集原始数据; - 数据存储:将采集到的数据存储到大数据平台中; - 数据清洗:对数据进行清洗,去除脏数据; - 数据处理:使用大数据技术对数据进行处理和分析; - 数据可视化:将处理后的结果以图形方式展现出来。 5. 大数据的挑战有哪些? 大数据的挑战主要包括以下几个方面: - 数据存储:海量数据的存储需要大量的存储空间; - 数据处理:海量数据的处理需要大量的计算资源; - 数据质量:大数据中存在大量的脏数据,需要进行数据清洗; - 数据安全:大数据中包含大量的敏感信息,需要保证数据安全; - 人才短缺:大数据技术需要专业的人才支持,但是目前人才供不应求。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值