VMware Cloud Director に 2 つのプライマリノードが表示される
search cancel

VMware Cloud Director に 2 つのプライマリノードが表示される

book

Article ID: 447052

calendar_today

Updated On:

Products

VMware Cloud Director

Issue/Introduction

免責事項: これは英文の記事「VMware Cloud Director shows two Primary Nodes」の日本語訳です。記事はベストエフォートで翻訳を進めているため、ローカライズ化コンテンツは最新情報ではない可能性があります。最新情報は英語版の記事を参照してください。

 

  • VMware Cloud Director (VCD) セルのクラスタでフェイルオーバーが発生した後、VAMI 上のクラスタのヘルスステータスが DEGRADED(低下) または READ ONLY(読み取り専用) となる。VAMI へは root ユーザで下記のアプライアンスの管理インターフェースへログインすることでアクセスできます。
    https://<primary_eth1_ip_address>:5480

  •  VAMI 上に 2 台のプライマリ セルが表示されます。一方は failed、もう一方は running のステータスとなっています。
  • 稼働中のプライマリセルへ SSH で接続し、コマンド "sudo -i -u postgres /opt/vmware/vpostgres/current/bin/repmgr cluster show" を実行すると下記のような出力になります。

     ID    | Name  | Role    | Status    | Upstream | Location | Priority | Timeline | Connection string
    -------+-------+---------+-----------+----------+----------+----------+----------+---------------------------------------------------------------------------------
     ###46 | Cell1 | standby |   running | Cell2    | default  | 100      | 4        | host=##.##.##.## user=repmgr dbname=repmgr gssencmode=disable connect_timeout=2
     ###07 | Cell2 | primary | * running |          | default  | 100      | 4        | host=##.##.##.## user=repmgr dbname=repmgr gssencmode=disable connect_timeout=2
     ###18 | Cell3 | primary | - failed  | ?        | default  | 100      |          | host=##.##.##.## user=repmgr dbname=repmgr gssencmode=disable connect_timeout=2

    WARNING: following issues were detected
      - unable to connect to node "Cell3" (ID: ###18)

  • VCD アプライアンス クラスター内のプライマリセルを再起動するなどのアクションを実行したことにより、自動フェイルオーバーがトリガーされました。
  • VCD セルがスプリットブレイン状態に陥っているように見え、プライマリセルが 2 つリストされます。

Environment

VMware Cloud Director 10.x

Cause

クラスタのフェイルオーバーが発生してプライマリセルが変更されましたが、以前のプライマリセルは Failed(失敗)状態のセルとしてクラスターの一部に組み込まれたままになっています。
Failed 状態のプライマリセルは破損しており現在のプライマリセルとは同期できていないため、VMware Cloud Director インフラストラクチャから削除することが必要です。VMware Cloud Director アプライアンスクラスターの健全性の詳細については、製品ドキュメント「VMware Cloud Director アプライアンス クラスタの健全性とフェイルオーバー モードの表示」を参照してください。

Resolution

VMware Cloud Director からスタンバイ セルを削除する手順は、次の製品ドキュメントを参照してください:Unregister a Running Standby Cell in Your VMware Cloud Director Database High Availability Cluster

スタンバイセルの登録解除のための Cloud Director API を使用できない場合は、Broadcom サポートに連絡し、問題の説明にこの記事の ID (447052) を記載してください。詳細については、「Broadcom サポートポータルでケースを作成および管理する方法」を参照してください。

プライマリ セルを再起動する必要があり、自動フェイルオーバーが有効になっている環境でこの問題の発生を回避するには、次のアクションを実行します。

  1. プライマリセルの切り替えを実行し、再起動を計画しているセルをスタンバイノードへ切り替えてから、対象のセルを再起動します。
  2. または、プライマリ セルの再起動中に自動フェイルオーバーが発生しないように、クラスターを「手動 (manual)」フェイルオーバー モードに変更します。
    WARNING: 手動フェイルオーバー モードでプライマリセルがパワーオフ状態になると、プライマリセルが再度起動されるまで VMware Cloud Director の UI は利用できなくなります。