MySQL分表实现上百万上千万记录分布存储的批量查询设计模式

MySQL分表实现上百万上千万记录分布存储的批量查询设计模式

Tim  http://hi.baidu.com/jabber/blog/category/Mysql

我们知道可以将一个海量记录的 MySQL 大表根据主键、时间字段,条件字段等分成若干个表甚至保存在若干服务器中。
唯一的问题就是跨服务器批量查询麻烦,只能通过应用程序来解决。谈谈在Java中的解决思路。其他语言原理类似。

这里说的分表不是 MySQL 5.1 的 partition,而是人为把一个表分开存在若干表或不同的服务器。

1. 应用程序级别实现

见示意图


SelectThreadManager 分表数据查询管理器
它为分表的每个database or server 建立一个 thread pool

addTask() - 添加任务
stopTask() - 停止任务
getResult() - 获取执行结果

最快的执行时间 = 最慢的 MySQL 节点查询消耗时间
最慢的执行时间 = 超时时间

某个 ThreadPool 忙时候处理流程
1. 假如 ThreadPoolN 非常忙,(也意味 DB N 非常忙);
2. 新的查询任务到来,addTask(), 新的任务的一个thread加到ThreadPoolN任务排队中
3. 外层应用已经获得其他 thread 返回结果,继续等待
4. 外层应用等待超时的时间到,调用 stopTask() 设置该任务全部 thread 中的停止标志, 外层应用返回。
5. 若干时间后,ThreadPoolN取到该排队 Thread, 因为设置了停止位,线程直接运行完成。


2. JDBC 层实现
做一个 JDBC Driver 的包装,拦截 PreparedStatement, Statement 的 executeQuery()
然后调用 SelectThreadManager 完成

3. MySQL partition
MySQL 5.1 的 partition 功能由于单张表的数据跨文件,批量查询时候同样存在上述问题,不过它是在 MySQL 内部实现的,不需要外部调用者关心。其查询实现的原理应该大致类似。
但 partition 只解决了 IO 的瓶颈,并不能解决 CPU 计算的瓶颈,因此无法代替传统的手工分表方式。
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
MySQL是一种常用的关系型数据库,它可以通过分库分表来优化大型数据库管理。分库分表是将一个大型的数据库拆分成多个数据库或多个数据表来减轻数据库负担,提高查询效率的技术。 分库分表实现原理如下: 1. 数据库分片 数据库分片是将一个逻辑数据库划分成若干个片(Shard),每个片都是一个完整的数据库,它包括一部分数据表和数据记录。分片可以按照不同的方式进行划分,例如按照数据范围(按照用户ID分片),按照分片键(按照订单号分片),或者按照一定的随机方式进行划分。 2. 基于路由的分片 当客户端查询时,需要路由到对应的分片中进行数据查询。数据库分片时常用的路由方式有哈希路由和范围路由两种。哈希路由是将查询的信息做哈希计算,从而决定它属于哪个分片;范围路由是根据分片键的范围决定它属于哪个分片。 3. 数据同步和数据迁移 分库分表和数据库分片不是一成不变的,需要进行数据同步和数据迁移来保证数据的一致性。数据同步可以使用主从复制(Master-Slave Replication)或者多主同步(Multiple-Master Replication)的方式进行。数据迁移则是在随着需求的变化,需要将某些数据迁移到其他的分片上,这可以使用在线迁移或者离线迁移的方式实现。 总的来说,分库分表实现的过程是先将原始逻辑数据库进行分片,然后根据查询语句路由到对应的分片中进行查询,最后通过数据同步和迁移来保证数据的一致性,从而达到分布式管理分库分表的目的。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、C币套餐、付费专栏及课程。

余额充值