MySQL制作具有千万条测试数据的测试库的方法

更新时间：2020年11月30日 09:06:54 作者：lichlaughing

这篇文章主要介绍了MySQL制作具有千万条测试数据的测试库的方法，帮助大家更好的理解和学习MySQL，感兴趣的朋友可以了解下

有时候需要制造一些测试的数据，以mysql官方给的测试库为基础，插入十万，百万或者千万条数据。利用一些函数和存储过程来完成。

官方给的测试库地址：https://github.com/datacharmer/test_db

导入官方的数据库，做了一些简化，留下了部门表，员工表和雇佣表三张表，去掉了外键关联。因为是测试数据，日期的对应关系不具备准确性。

必要的函数

生成随机字符串

RAND()：生成0~1之间的随机数

FLOOR：向下整数（FlOOR(1.2)=1）

CEILING 向上取整（CEILING(1.2)=2）

substring：截取字符串

concat：字符串连接

CREATE DEFINER=`root`@`localhost` FUNCTION `rand_string`(n INT) RETURNS varchar(255) CHARSET latin1
BEGIN
	DECLARE chars_str 	varchar(100) DEFAULT 'ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklmnopqrstuvwxyz';
  DECLARE return_str 	varchar(255) DEFAULT '';
  DECLARE i INT DEFAULT 0;
  WHILE i < n DO
    SET return_str = concat(return_str,substring(chars_str , FLOOR(1 + RAND()*62 ),1));
    SET i = i +1;
  END WHILE;
  RETURN return_str;
END

查看自定义的所有函数

show function status

测试使用：

select rand_string(5);

生成随机年月日字符串

生成一个指定时间段内的随机日期

SELECT
	date(
	from_unixtime( unix_timestamp( '2000-01-01' ) + floor( rand() * ( unix_timestamp( '2020-12-31' ) - unix_timestamp( '2000-01-01' ) + 1 ) ) ));

函数：生成指定时间段内的随机日期

CREATE DEFINER=`root`@`localhost` FUNCTION `rand_date_string`(startDate varchar(255),endDate varchar(255)) RETURNS varchar(255) CHARSET latin1
BEGIN
  DECLARE return_str varchar(255) DEFAULT '';
	
	 SET return_str =date(
		from_unixtime( unix_timestamp( startDate ) 
				+ floor( rand() * ( unix_timestamp( endDate ) - unix_timestamp( startDate ) + 1 ) ) 
			)
	 );
  
  RETURN return_str;
END

测试使用：

select rand_date_string('2000-01-01','2020-12-31');
//结果
2001-09-10

存储过程生成数据

给每个部门插入一百万员工，那么员工表就有九百万的数据。

CREATE DEFINER=`root`@`localhost` PROCEDURE `data`()
BEGIN
	
	DECLARE i INT DEFAULT 1;
	DECLARE j INT DEFAULT 0;
	DECLARE id INT DEFAULT 0;
	WHILE i < 10 DO
			WHILE j < 1000000 DO
				insert into employees_m (emp_no,birth_date,first_name,last_name,gender,hire_date) VALUES(
					id,rand_date_string('1970-01-01','1997-01-01'),rand_string(5),rand_string(5),'M',NOW());
				
				insert into dept_emp_m (emp_no,dept_no,from_date,to_date) values(
					 id,concat('d00',i),rand_date_string('1990-01-01','2020-12-31'),'2020-12-31');
					 
			SET j=j+1;  
			SET id=id+1;  
			END WHILE;
	SET j = 0;
	SET i=i+1;   
	END WHILE;

END

插入九百万条数据大概用时：4868s

上面的方式插入数据会很慢，可以将数据插入到内存表，就是将表的存储引擎修改为MEMORY这样就会使用内存去存储数据，会比直接插入到INNODB引擎的表中快很多，只不过就是没有持久化，但是速度贼快，插入一千万条数据大概需要时间: 1227.89s

附录

修改表存储引擎

ALTER TABLE dept_emp_m ENGINE=MEMORY;

调整内存表的大小，修改配置文件

[mysqld]
max_heap_table_size = 2048M
tmp_table_size = 2048M

以上就是MySQL制作具有千万条测试数据的测试库的方法的详细内容，更多关于MySQL 千万条测试数据的资料请关注脚本之家其它相关文章！

您可能感兴趣的文章:

Mysql最新版本的数据库安装教程（5.7）
这篇文章主要为大家详细介绍了Mysql最新版本的数据库安装教程，分享了Mysql 5.7安装配置方法，感兴趣的小伙伴们可以参考一下
2016-07-07
MySQL实现模糊查询的高效方法总结(附30条优化建议)
数据库SQL优化是老生常谈的问题,在面对模糊查询的时候又有什么好的优化建议呢?这篇文章主要给大家介绍了关于MySQL实现模糊查询的高效方法,文中还附30条优化建议,需要的朋友可以参考下
2024-03-03
MySQL InnoDB中的锁机制深入讲解
这篇文章主要给大家介绍了关于MySQL InnoDB中锁机制的相关资料，文中通过示例代码介绍的非常详细，对大家学习或者使用MySQL具有一定的参考学习价值，需要的朋友们下面来一起学习学习吧
2019-05-05
$MySQL更新存放JSON的字段、\“ 转义成 “的问题描述$
MySQL更新存放JSON的字段、\“ 转义成 “的问题描述
本篇介绍在执行MySQL线上变更时遇到的问题，表现为"更新JSON字段时，实际更新的值与SQL语句中的值不一致，JSON格式错误"，本文给大家分享问题描述及解决方案，感兴趣的朋友一起看看吧
2022-12-12
MLSQL编译时权限控制示例详解
这篇文章主要给大家介绍了关于MLSQL编译时权限控制的相关资料，文中通过示例代码介绍的非常详细，对大家学习或者使用mysql具有一定的参考学习价值，需要的朋友们下面来一起学习学习吧
2019-03-03
MySQL查询重复数据（删除重复数据保留id最小的一条为唯一数据）
查重是我们在工作中经常会遇到的一个需求，下面这篇文章主要给大家介绍了关于MySQL查询重复数据（删除重复数据保留id最小的一条为唯一数据）的相关资料，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面来一起学习学习吧
2019-03-03
mysql实现将date字段默认值设置为CURRENT_DATE
这篇文章主要介绍了mysql实现将date字段默认值设置为CURRENT_DATE问题，具有很好的参考价值，希望对大家有所帮助。如有错误或未考虑完全的地方，望不吝赐教
2023-07-07
Mysql my.cnf配置文件参数详解
Linux 操作系统中 MySQL 的配置文件是 my.cnf,一般会放在 /etc/my.cnf 或 /etc/mysql/my.cnf 目录下,这篇文章主要介绍了Mysql my.cnf配置文件参数详解,需要的朋友可以参考下
2023-11-11
MySQL算术/比较/逻辑/位/运算符与正则举例详解
每种数据库都支持SQL语句,但是它们也都有各自支持的运算符,下面这篇文章主要给大家介绍了关于MySQL算术/比较/逻辑/位/运算符与正则的相关资料,文中通过实例代码介绍的非常详细,需要的朋友可以参考下
2023-02-02
浅谈如何保证Mysql主从一致
这篇文章主要介绍了浅谈如何保证Mysql主从一致
2022-03-03

MySQL制作具有千万条测试数据的测试库的方法

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具