Microsoft 故障转移集群环境概述

通过 Microsoft Failover Cluster Manager ,可以将 IBM Storage Protect 服务器集群资源放入集群组中。 IBM Storage Protect 群集组有一个网络名称、一个 IP 地址、一个或多个物理磁盘、一个 IBM Db2 服务器和一个 IBM Storage Protect 服务器服务。

IBM Storage Protect 实例网络名与运行 IBM Storage Protect 集群组的物理节点的名称无关。 客户机使用实例网络名 (而不是 Windows 节点名) 连接到 IBM Storage Protect 服务器。 实例网络名称映射到主节点或备份节点。 映射取决于哪个节点拥有集群组。 使用 Windows 因特网名称服务 (WINS) 或目录服务来查找服务器的任何客户机都可以在 IBM Storage Protect 集群服务器在节点之间移动时自动跟踪该服务器。 您可以在不修改或重新配置客户机的情况下自动跟踪集群服务器。

每个 IBM Storage Protect 集群组都有自己的磁盘作为集群资源组的一部分。 IBM Storage Protect 集群组无法在集群组之间共享数据。 集群组中配置的每个 IBM Storage Protect 服务器都在单独的磁盘上具有其数据库,活动日志,恢复日志和存储池卷集。 该磁盘归在其中配置服务器的集群组所有。

请记住: Microsoft Failover Cluster Manager 仅支持 IP 地址作为资源。 因此,任何在集群上 IBM Storage Protect 运行的服务器都必须将其支持的通信方式仅限于 TCP/IP。 任何未将 TCP/IP 作为通信方式的客户端,在集群发生故障转移至其他集群节点时,都将无法连接到该 IBM Storage Protect 集群组。

以下示例演示了 IBM Storage Protect 集群服务器的 Microsoft Failover Cluster Manager 的工作方式。

假定名为 JUPITER 的集群 IBM Storage Protect 服务器正在节点 Z 上运行,而名为 SATURN 的集群 IBM Storage Protect 服务器正在节点 X 上运行。客户机连接到 IBM Storage Protect 服务器 JUPITER 和 IBM Storage Protect 服务器 SATURN ,而不知道哪个节点托管其服务器。

图 1。 以 JUPITER 作为节点 Z 且 SATURN 作为节点 X 的集群
以 JUPITER 作为节点 Z 且 SATURN 作为节点 X 的集群
当某个软件或硬件资源发生故障时,就会发生故障转移。 资源(例如应用程序、磁盘和 IP 地址)会从发生故障的节点移至剩余的节点。 其他节点完成以下操作:
  • 接管 IBM Storage Protect 集群组
  • 使磁盘资源,网络资源和 Db2 资源联机
  • 重新启动 IBM Storage Protect 服务
  • 向管理员和客户机提供访问权

如果节点 X 发生故障,将由节点 Z 负责运行 SATURN。 对客户机来说,就像是节点 X 被关闭然后又立即打开。 客户机会丢失至 SATURN 的所有连接,并且所有活动的事务都会回滚到客户机。 丢失连接后,客户机必须重新连接到 SATURN。 客户机不知道 SATURN 的位置。