mysql 测试数据的脚本_MySQL制作具有千万条测试数据的测试库的方法

最新推荐文章于 2024-05-21 22:22:16 发布

海蒂妈妈

最新推荐文章于 2024-05-21 22:22:16 发布

阅读量149

点赞数

文章标签： mysql 测试数据的脚本

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_42524610/article/details/113203815

版权

有时候需要制造一些测试的数据，以mysql官方给的测试库为基础，插入十万，百万或者千万条数据。利用一些函数和存储过程来完成。

导入官方的数据库，做了一些简化，留下了部门表，员工表和雇佣表三张表，去掉了外键关联。因为是测试数据，日期的对应关系不具备准确性。

必要的函数

生成随机字符串

RAND()：生成0~1之间的随机数

FLOOR：向下整数 (FlOOR(1.2)=1)

CEILING 向上取整 (CEILING(1.2)=2)

substring：截取字符串

concat：字符串连接

CREATE DEFINER=`root`@`localhost` FUNCTION `rand_string`(n INT) RETURNS varchar(255) CHARSET latin1

BEGIN

DECLARE chars_str varchar(100) DEFAULT 'ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklmnopqrstuvwxyz';

DECLARE return_str varchar(255) DEFAULT '';

DECLARE i INT DEFAULT 0;

WHILE i < n DO

SET return_str = concat(return_str,substring(chars_str , FLOOR(1 + RAND()*62 ),1));

SET i = i +1;

END WHILE;

RETURN return_str;

END

查看自定义的所有函数

show function status

测试使用：

select rand_string(5);

生成随机年月日字符串

生成一个指定时间段内的随机日期

SELECT

date(

from_unixtime( unix_timestamp( '2000-01-01' ) + floor( rand() * ( unix_timestamp( '2020-12-31' ) - unix_timestamp( '2000-01-01' ) + 1 ) ) ));

函数：生成指定时间段内的随机日期

CREATE DEFINER=`root`@`localhost` FUNCTION `rand_date_string`(startDate varchar(255),endDate varchar(255)) RETURNS varchar(255) CHARSET latin1

BEGIN

DECLARE return_str varchar(255) DEFAULT '';

SET return_str =date(

from_unixtime( unix_timestamp( startDate )

+ floor( rand() * ( unix_timestamp( endDate ) - unix_timestamp( startDate ) + 1 ) )

)

);

RETURN return_str;

END

测试使用：

select rand_date_string('2000-01-01','2020-12-31');

//结果

2001-09-10

存储过程生成数据

给每个部门插入一百万员工，那么员工表就有九百万的数据。

CREATE DEFINER=`root`@`localhost` PROCEDURE `data`()

BEGIN

DECLARE i INT DEFAULT 1;

DECLARE j INT DEFAULT 0;

DECLARE id INT DEFAULT 0;

WHILE i < 10 DO

WHILE j < 1000000 DO

insert into employees_m (emp_no,birth_date,first_name,last_name,gender,hire_date) VALUES(

id,rand_date_string('1970-01-01','1997-01-01'),rand_string(5),rand_string(5),'M',NOW());

insert into dept_emp_m (emp_no,dept_no,from_date,to_date) values(

id,concat('d00',i),rand_date_string('1990-01-01','2020-12-31'),'2020-12-31');

SET j=j+1;

SET id=id+1;

END WHILE;

SET j = 0;

SET i=i+1;

END WHILE;

END

插入九百万条数据大概用时：4868s

上面的方式插入数据会很慢，可以将数据插入到内存表，就是将表的存储引擎修改为MEMORY这样就会使用内存去存储数据，会比直接插入到INNODB引擎的表中快很多，只不过就是没有持久化，但是速度贼快，插入一千万条数据大概需要时间: 1227.89s

附录

修改表存储引擎

ALTER TABLE dept_emp_m ENGINE=MEMORY;

调整内存表的大小，修改配置文件

[mysqld]

max_heap_table_size = 2048M

tmp_table_size = 2048M

以上就是MySQL制作具有千万条测试数据的测试库的方法的详细内容，更多关于MySQL 千万条测试数据的资料请关注脚本之家其它相关文章！

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
mysql 测试数据的脚本_MySQL制作具有千万条测试数据的测试库的方法

有时候需要制造一些测试的数据，以mysql官方给的测试库为基础，插入十万，百万或者千万条数据。利用一些函数和存储过程来完成。导入官方的数据库，做了一些简化，留下了部门表，员工表和雇佣表三张表，去掉了外键关联。因为是测试数据，日期的对应关系不具备准确性。必要的函数生成随机字符串RAND()：生成0~1之间的随机数FLOOR：向下整数 (FlOOR(1.2)=1)CEILING 向上取整 (CEILI...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。