您现在的位置是:亿华云 > 应用开发
5000多张数据表,如何用SQL迁移到数据仓库?
亿华云2025-10-04 22:11:11【应用开发】7人已围观
简介需求背景最近公司打算集中梳理几大业务系统的数据,希望将各个业务系统中的数据集中到数据仓库中。总共有5000多张数据表,但是好在业务数据量没有像电商那么庞大,也就几十个G。需求分析其实这个需求很简单,就
需求背景
最近公司打算集中梳理几大业务系统的多张到数数据,希望将各个业务系统中的数据数据集中到数据仓库中。总共有5000多张数据表,表何但是迁移好在业务数据量没有像电商那么庞大,也就几十个G。据仓
需求分析
其实这个需求很简单,多张到数就是数据把这5000多张不同数据库中的表放到一个地方。需要注意的表何有以下几点:
1、数据来自各种不同类型的迁移数据库,有SQL Server,据仓MySQL和Oracle
2、多张到数表的数据数据量较多,一个一个写查询代码肯定不现实
3、表何后续数据仓库的迁移维护
方案建议
由于数据量不是很大,我打算用DBLINK来实现从不同的据仓库中抽取数据到数据仓库中。
方案思路
1、创建不同的DBLINK
数据仓库我们目前使用的是SQL Server的服务器,整体性能还可以。但是服务器租用业务系统的数据库类型不一,在新建DBLINK时有不同的要求:
a、针对SQL Server的业务数据库可以直接在服务器上新建
b、针对MySQL和Oracle的业务数据库需要先使用ODBC作用中间组件来配置。
2、查询数据库中的所有表表名
每个业务数据库都是全库抽取,那么首先需要找到这些数据库中的所有表。这里我们以SQL Server为例来查找数据库中的所有表。
SELECT NAME FROM SYSOBJECTS WHERE TYPE=U上面的代码就可以把当前库中的所有表的表名都给查询出来,我这里在家里电脑测试了一下,给大家看下截图:
大家也可以在自己的电脑上试一试就知道了。
Oracle获取用户表表名的代码如下:
SELECT * FROM USER_TABLES;MySQL获取用户表表名的代码如下:
select table_name from information_schema.tables where table_schema=db_name;3、循环抽取数据
我们在完成上面两步后,就可以开始循环抽取各业务系统的数据了。这里我们需要写一个游标来循环执行。具体代码如下:
DECLARE @TableName varchar(50),@Sql varchar(500) --定义两个变量,一个用来存储表名,一个用来存储插入语句 DECLARE cursor_variable CURSOR FOR --定义一个游标,源码下载并且将目标表的所有表名插入游标中 select name from [192.168.0.39].[test].[dbo].sysobjects where xtype=u order by name; OPEN cursor_variable --打开游标 FETCH NEXT FROM cursor_variable INTO @TableName --获取游标中的数据插入到变量中 WHILE @@FETCH_STATUS=0 --循环执行,当游标中的数据被读完为止 BEGIN SET @Sql=select * into dbo.+@TableName + from [192.168.0.39].[test].[dbo].+@TableName Exec @Sql FETCH NEXT FROM cursor_variable INTO @TableName END CLOSE cursor_variable --关闭游标 DEALLOCATE cursor_variable; --释放游标目前只是测试代码,后续在性能上还可以继续优化。
4、设置定时任务
代码写好了,肯定不可能每天手动去执行,这时候我们可以使用数据库的定时任务,这个我在以前的文章中有提到过。《数据库任务自动化其实很简单,JOB的简单介绍》
我们把代码放到定时任务里面,让它每天凌晨1点执行即可。
总结
这个办法在处理数据量不多的情况下是可行的,如果数据量较大,性能上会存在较大风险。下面我们回顾一下做了哪些内容:
1、创建不同数据库的DBLINK
2、查询到每个数据库的所有表名
3、使用游标循环插入到数据仓库
4、设置定时任务执行上面的游标
每个步骤都可能会存在问题,但是源码库只要把这些问题都解决了,这件事就解决了。
觉得不错,记得转发分享给更多人~
很赞哦!(97)
相关文章
- 4.选择顶级的域名注册服务商
- 换个角度思考性能测试问题和学习性能测试实践
- 从技术角度聊聊,短视频为何让人停不下来?
- 开发者Jonathan Blow 认为 C++ 是一种可怕的语言
- 2、定期提交和投标域名注册。例如,益华网络点击“立即预订”后,平台会抢先为客户注册域名。当然,一个域名可能会被多个客户预订,所以出价最高的人中标。
- ASP.NET Core值得学吗?
- 你必须了解的微服务架构设计的10个要点!
- 更深入的理解Python中的迭代
- 付款完成后,您只需耐心等待,如果您注册成功,系统会提示您。这里需要注意的是,域名是一个即时产品,只有在最终付款成功时才能预订,注册成功后不能更改。
- 写了100万行代码的程序员是什么样的程序员