OpenTSDB-时序数据库（更新中）

最新推荐文章于 2024-08-16 14:26:28 发布

wise_nut

最新推荐文章于 2024-08-16 14:26:28 发布

阅读量563

点赞数 1

分类专栏： learing

本文链接：https://blog.csdn.net/wise_nut/article/details/106344869

版权

OpenTSDB是一个时间序列数据库，基于HBase提供毫秒级精度的数据存储。文章介绍了OpenTSDB如何通过数据存储优化，如缩短row key、减少Key-Value数，来提升查询效率和减少存储空间。此外，还讲述了OpenTSDB如何处理并发写入的优化策略，以解决写热点问题。最后，提到了数据写入与查询的API。

摘要由CSDN通过智能技术生成

前言：

原本地址.
文章参考了OpenTSDB文档，以及其他网友的优质博客，结合自己的一些理解，也算是边学边写博客了

1. 简介

OpenTSDB(Open time series data base)，时间序列数据库。顾名思义，就是以时间为标签存储数据，它的特点是能够提供最高 毫秒级精度 的时间序列数据存储，能够长久保存原始数据并且不失精度。但是OpenTSDB这个db有误导性，他其实只是一层读写服务（基于HBase）
HBase可以看我另一篇文章： HBase架构基础和结构模型.

1.1 什么是时序数据？

    股票的变化趋势、温度的变化趋势、系统某个指标的变化趋势……其实都是时序数据，就是每个时间点上纪录一条数据。关于数据的存储，我们最熟悉的就是mysql了，但是想想看，每5分钟存储一个点，一天288个点，一年就10万+，这还是单个维度，往往在实际应用中维度会非常多，比如股票交易所，成千上万支股票，每天所有股票数据就可能超过百万条，如果还得支持历史数据查询，mysql是远远扛不住的，必然要考虑分布式存储，最好的选择就是Hbase了，事实上业内基本上也是这么做的。
    了解Hbase的人都知道，它可以通过加机器的水平扩展迅速增加读写能力，非常适合存储海量的数据，但是它并不是关系数据库，无法进行类似mysql那种select、join等操作。取而代之的只有非常简单的Get和Scan两种数据查询方式。这里不讨论Hbase的相关细节，总之，你可以通过Get获取到hbase里的一行数据，通过Scan来查询其中RowKey在某个范围里的一批数据。如此简单的查询方式虽然让hbase变得简单易用，但也限制了它的使用场景。针对时序数据，只有get和scan远远满足不了你的需求。
    这个时候OpenTSDB就应运而生。首先它做了数据存储的优化，可以大幅度提升数据查询的效率和减少存储空间的使用。其次它基于hbase做了常用时序数据查询的API，比如数据的聚合、过滤等。另外它也针对数据热度倾斜做了优化。