时间:2021-05-02
需求背景
最近公司打算集中梳理几大业务系统的数据,希望将各个业务系统中的数据集中到数据仓库中。总共有5000多张数据表,但是好在业务数据量没有像电商那么庞大,也就几十个G。
需求分析
其实这个需求很简单,就是把这5000多张不同数据库中的表放到一个地方。需要注意的有以下几点:
1、数据来自各种不同类型的数据库,有SQL Server,MySQL和Oracle
2、表的数据量较多,一个一个写查询代码肯定不现实
3、后续数据仓库的维护
方案建议
由于数据量不是很大,我打算用DBLINK来实现从不同的库中抽取数据到数据仓库中。
方案思路
1、创建不同的DBLINK
数据仓库我们目前使用的是SQL Server的服务器,整体性能还可以。但是业务系统的数据库类型不一,在新建DBLINK时有不同的要求:
a、针对SQL Server的业务数据库可以直接在服务器上新建
b、针对MySQL和Oracle的业务数据库需要先使用ODBC作用中间组件来配置。
2、查询数据库中的所有表表名
每个业务数据库都是全库抽取,那么首先需要找到这些数据库中的所有表。这里我们以SQL Server为例来查找数据库中的所有表。
SELECTNAMEFROMSYSOBJECTSWHERETYPE='U'
上面的代码就可以把当前库中的所有表的表名都给查询出来,我这里在家里电脑测试了一下,给大家看下截图:
大家也可以在自己的电脑上试一试就知道了。
Oracle获取用户表表名的代码如下:
SELECT*FROMUSER_TABLES;
MySQL获取用户表表名的代码如下:
selecttable_name
frominformation_schema.tables
wheretable_schema='db_name';
3、循环抽取数据
我们在完成上面两步后,就可以开始循环抽取各业务系统的数据了。这里我们需要写一个游标来循环执行。具体代码如下:
DECLARE@TableNamevarchar(50),@Sqlvarchar(500)
--定义两个变量,一个用来存储表名,一个用来存储插入语句
DECLAREcursor_variableCURSORFOR
--定义一个游标,并且将目标表的所有表名插入游标中
selectnamefrom[192.168.0.39].[test].[dbo].sysobjectswherextype='u'orderbyname;
OPENcursor_variable
--打开游标
FETCHNEXTFROMcursor_variable
INTO@TableName
--获取游标中的数据插入到变量中
WHILE@@FETCH_STATUS=0
--循环执行,当游标中的数据被读完为止
BEGIN
SET@Sql='select*intodbo.'+@TableName+'from[192.168.0.39].[test].[dbo].'+@TableName
Exec@Sql
FETCHNEXTFROMcursor_variable
INTO@TableName
END
CLOSEcursor_variable
--关闭游标
DEALLOCATEcursor_variable;
--释放游标
目前只是测试代码,后续在性能上还可以继续优化。
4、设置定时任务
代码写好了,肯定不可能每天手动去执行,这时候我们可以使用数据库的定时任务,这个我在以前的文章中有提到过。《数据库任务自动化其实很简单,JOB的简单介绍》
我们把代码放到定时任务里面,让它每天凌晨1点执行即可。
总结
这个办法在处理数据量不多的情况下是可行的,如果数据量较大,性能上会存在较大风险。下面我们回顾一下做了哪些内容:
1、创建不同数据库的DBLINK
2、查询到每个数据库的所有表名
3、使用游标循环插入到数据仓库
4、设置定时任务执行上面的游标
每个步骤都可能会存在问题,但是只要把这些问题都解决了,这件事就解决了。
觉得不错,记得转发分享给更多人~
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
一、描述在利用django做网络开发的时候我们会遇到一个问题就是,我们建立了多张数据表,但是多张数据表中的内容是不一样的,但是之间有着联系比如:我有两张表,一张
什么是模型?我们的WEB系统一定会和各种数据打交道,实际开发过程中,往往一个类对应了关系数据库的一张或多张数据表,这里就会出现两个问题。1.类和数据表,一方修改
今天有一老同学问我一个用存储过程创建数据表的问题,这可把我问住了,我不会用SQLServer的存储过程创建数据表!就是ORACLE我也刚刚学会如何用动态SQL创
易语言自带的数据库EDB,操作很简单,其实他本身不能叫做数据库,实质只是一张数据表。没有SQLite那种支持SQL语句的操作数据库方便。不过,适合没有编程经验的
MySQL的默认的调度策略可用总结如下:·写入操作优先于读取操作。·对某张数据表的写入操作某一时刻只能发生一次,写入请求按照它们到达的次序来处理。·对某张数据表