Teradata数据库和Informatica ETL逻辑及视图、用户定义函数和存储过程迁移到AWS的Hive数据仓库基本流程

首先,我们需要注册AWS帐号,并启用EC2(Elastic Cloud Computing,高性能云计算)、EMR(Elastic Map-Reduce,高性能大数据计算)、Redshift/Snowflake数据仓库和S3(Simple Storage Service,简单存储服务)、DevOps(用于Github持续集成)和Github Enterprise这些服务。
其次,我们需要梳理清楚Teradata数据库中Informatica Designer中的数据源、目标表和数据转换映射对象中的表、视图以及用户定义函数和存储过程之间的依赖关系。操作上可以使用Teradata的SHOW语句,如SHOW TABLE <表名>、SHOW VIEW <视图名>、SHOW PROCEDURE <存储过程名>、SHOW FUNCTION <用户定义函数名>,以及DBC架构下面的系统视图如DBC.Tables、DBC.Columns来查看数据库对象之间的关系。
Teradata数据库中的DBC.Tables和DBC.Columns用法如下所示。
1.查询数据库的所有表和视图
select * from DBC.Tables where databasename=’<数据库名>’ and TableKind IN (‘T’,‘V’)
2.查询表的所有列的信息
select * from DBC.Columns where databasename=’<数据库名>’ and tablename=’<表名/视图名>’
对于数据迁移,如果EMR集群可以连接到Teradata服务器,我们可以用sqoop、Hortonworks Connector或Teradata Connector for Hadoop(TDCH)来同时连接数据库和Hive数仓

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值