用DataStage 进行数据整合 DataStage 的开发环境是基于 C/S 模式的,通过 DataStage Client 连接到DataStage Server 上进行开发
这里有一点需要注意,DataStage Client 只能安装在 Windows 平台上面
而 DataStage Server 则支持多种平台,比如 Windows、Redhat Linux、AIX、HP-UNIX
DataStage Client 有四种客户端工具
分别是 DataStage Administrator、DataStage Designer、DataStage Manager、DataStage Director
接下来首先介绍这几种客户端工具在 DataStage 架构中所处的位置以及它们如何协同工作来开发 ETL Job 的,接着再分别详细介绍每个工具的功能
图 1 描述了 IBM WebSphere DataStage 的整个系统架构
DataStage 的客户端工具连接到DataStage Server 上进行 ETL Job 的开发,DataStage Server 再与后台的数据库连接起来进行数据处理
DataStage 的客户端工具之间的是一个相互合作的关系
下面通过介绍 ETL Job 的开发过程来介绍他们之间的这种关系
ETL Job 开发流程 1. 用 DataStage Administrator 新建一个项目; 2. 用 DataStage Designer 连接到这个新建的项目上进行ETL Job 的设计; 3. 用 DataStage Director 对设计好的ETL Job 设置运行的模式,比如多长时间运行一次 ETL Job; 4.用 DataStage Manager 进行ETL Job 的备份等
图 1:IBM WebSphere