今日のビジネス環境ではクラウド技術の導入が急速に進んでいるため、サービスの中断や停止につながる災害から効果的に復旧できる能力は、これまで以上に重要になっています。クラウドベースの災害復旧により、組織はデータとサービスの稼働時間を可能な限り短時間で復旧できます。
クラウド災害復旧とは?
災害復旧とは、組織が災害に備え、そこから復旧するためのプロセスを指します。組織の事業継続計画に不可欠な要素として、災害復旧は組織の資産を保護することを目指します。したがって、クラウド災害復旧計画とは、クラウドプロバイダーが提供する専用設備を活用し、組織が円滑に運営され続けることを確実にするための一連の手順と対策です。
クラウド災害の発生
クラウド災害への備え方を知るには、こうした災害がどのように発生する可能性があるのかを理解することが重要です。まず、電力やネットワーク接続が途絶える場合など、技術的な障害という形で、ビジネス資産がクラウド災害にさらされる可能性があります。
次に、利用しているクラウドサービスをホスティングするサーバーが置かれた地域で、暴風雨、洪水、地震などの自然災害が発生し、サービスの停止や中断につながる可能性があります。
クラウド災害は人的要因によるものとして発生することもあります。これは自然災害よりも一般的で、単純なミスが大規模なサービス中断を引き起こす場合があります。こうした事象はクラウドサービスの利用中に起こることが多く、残念ながら完全になくすことはできません。例えば、入力ミスや単純な設定ミス、誤った削除、ソフトウェア更新の怠りなどが引き金となり、脅威アクターがクラウドサービスを掌握しやすくなる可能性があります。
ランサムウェアなどのマルウェアを通じて脅威アクターがクラウドサービスにアクセスすると、組織のインフラにとって脅威となります。こうした脅威アクターは容易にサービスを停止させ、利益を得るために業務を深刻かつ厄介な形で妨害できます。ランサムウェアは現在のクラウドデータにとって大きな課題であり、こうした脅威が進化を続けている事実が、問題をいっそう深刻なものにしています。
クラウド災害への備え
クラウド災害に備えるには、データ復旧のフレームワークを継続的にテストする必要があります。企業が実施できるテストには、次のようなものがあります。
- 完全中断テスト実施可能な中で最も綿密なテストである完全中断テストでは、業務を停止し、災害を再現して、実際の災害に企業がどのように対応するかを評価します。コストがかかる可能性があり、失敗した場合には意図せず大規模な混乱を引き起こすおそれがあります。
- ウォークスルーテスト完全中断テストよりもはるかに簡易なこのテストでは、災害復旧計画を確認し、計画の改善に向けて不足している点を特定する機会を得られます。
- 並行テスト復旧作業をプライマリシステムとは別のネットワーク上で実施します。
- シミュレーションテスト災害をシミュレーションし、チームに文書化された災害復旧計画の実行を想定させます。対応者の準備状況と既存戦略の有効性を評価するため、無作為に実施することもできます。
クラウド災害復旧の重要性
クラウド災害復旧により、物理インフラへの依存を減らせます。災害復旧のワークロードを外部委託できるため、企業の運用負担が軽減されます。さらに企業は、遠隔サイトにある災害復旧用の物理インフラをアップグレードしたり、サポートしたりする必要もありません。クラウドベースのサービスには、自動化などの付加的な利点もあり、人的ミスを軽減する方法の1つとなります。
クラウド災害復旧では、オンプレミスの災害復旧と比べて、よりシンプルに運用できます。独自の災害復旧プロセスの管理に伴う複雑さは、クラウドの手法によって簡素化されます。例えば、データ復旧のフレームワークのテストが容易になるだけでなく、実施しやすくなります。
さらに、企業は復旧手法を選択する際に大きな柔軟性を得られます。必要なサービスを損なうことなく、さまざまな復旧手法を費用対効果の高い形で組み合わせられます。クラウド災害復旧の選択肢は高い拡張性を備えており、従量課金モデルなどに基づいてサーバーやインフラを拡張できます。
関連記事:ランサムウェアからバックアップを強化する
クラウド災害復旧のベストプラクティス
適切な災害復旧計画の方法を選ぶ
適切な災害復旧計画を策定するには、自社のITインフラを理解することが重要です。これにより、災害復旧計画に適した方法を選択できます。例えば、バックアップとリストアの方法を使用し、マネージドバックアップソリューションによって都合のよいタイミングでデータのバックアップと復元を処理できます。
要件によっては、パイロットライト構成が有効です。このアプローチでは、アクティブなリソースを削減して災害復旧のコストを抑えます。また、重要なデータとアプリケーションを1か所に配置することで、災害発生時のデータ復旧も容易になります。そのほかの方法には、データとアプリケーションの完全なレプリカを2か所以上のアクティブなロケーションに展開するホットスタンバイや、システムの中核要素を複製してシステムと同時に稼働させるウォームスタンバイがあります。
詳しく読む:ハイブリッドクラウドインフラ全体での災害復旧
対応力のある災害復旧サービスプロバイダーを選ぶ
戦略的な災害復旧の評価と計画には、綿密に定義された手順が必要ですが、自社だけでは実施できない場合があります。例えば、災害復旧サービスプロバイダーは、詳細なビジネスインパクト分析の実施を支援し、災害時に起こり得る業務上の制約を把握するのに役立ちます。
そのため、実効性の高いクラウド災害復旧計画の策定を支援できる、知見が豊富で現実的かつソリューション志向のサービスプロバイダーを選ぶことが重要です。こうしたプロバイダーは、ユースケースに適したツールを備えています。また、データに対する潜在的な危険をより適切に評価することもできます。
災害復旧計画のRPOとRTOを定義する
復旧ポイント目標(RPO)および復旧時間目標(RTO)は、組織の災害復旧計画を策定する際に重要な指標です。特定のサービスが中断した際の事業継続を保証する指標となります。
RPOは、災害時に許容できるデータ損失量を組織が把握するのに役立ちます。一方、RTOは、災害後に組織のインフラが稼働状態を回復するまでに許容される時間を定め、災害の軽減と復旧のための手順にも関係します。そのため、RTOとRPOを考慮することで、組織は復旧目標を満たす災害復旧フレームワークを決定できます。
計画を定期的にテストし、更新する
災害復旧計画を定期的にテストすることで、災害発生時に計画が期待どおり機能するかを評価できます。さらに、災害復旧の目標はビジネス目標と一致している必要があるため、ビジネス環境が絶えず変化する中では、災害復旧計画が陳腐化していないことを確認するため、常にテストすることがいっそう重要になります。
情報技術も定期的に変化しています。そのため、技術の進歩に対応するには、テストだけでなく災害復旧計画の更新も行い、計画の有効性を段階的に高められるよう、組織のインフラもそれに応じて発展させる必要があります。
災害復旧をサービスとして利用する
組織内に災害復旧チームがない場合、サービスとしての災害復旧(DRaaS)が有力な選択肢となります。DRaaSプロバイダーは、組織のビジネスニーズに合わせたベストプラクティスを提供できます。DRaaSはクラウドリソースを使用するため、災害時に組織のミッションクリティカルなデータを保護する二次インフラを容易に構築できます。
DRaaSは、支払った分だけ利用できるため、組織のコスト削減にもつながります。例えば、このような計画では、使わないストレージ容量に対して料金を支払うことはありません。さらに、DRaaSは社内構築型のソリューションと比べ、災害発生後の復旧時間を短縮できる可能性があります。