第三章 基础数据和技术指标 | 原始数据及预处理

第三章 基础数据和技术指标

 

一、原始数据及预处理

 

数据是整个系统的基础,大数据是量化金融的根本。相比传统数据,期权量化大数据:

1、数据规模大、更新快:大数据的数据量非常大,实时更新,不能用传统静态工具和传统数据库分析工具分析。

2、非结构化数据、维度高:传统数据主要在关系性数据库中分析,而大数据需要从更高维度挖掘和处理。

3、数据表征处理方式不同:为以后机器学习和样本模型化表征,需要用高维度数据表征工具进行预处理,python 的 numpy 和 pandas 是基础必备的高效率工具。

 

通过第三方数据接口及接口解析获取秒级实时行情原始数据。进行数据加工和存储。

为保障实时性,采用MongoDB数据库进行线上处理加工(秒级),采用MySQL进行历史存储备份(每日)。

下图是对实时及历史数据的数据清洗及分析,数据加工,数据诊断预警,数据可视化及数据储存备份。

 

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

阿岛格

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值