バックアップには膨大なストレージ容量が必要になることがある。
かつては、毎週、場合によっては毎日、新たなバックアップを実行する企業もあった。すべてのバックアップから全データを保存するため、一部のファイルが数百、場合によっては数千ものコピーに増えることもあった。増分バックアップによってストレージの負担は軽減された。完全バックアップは時折、新たに実行すればよい。毎日のバックアップでは、新規ファイルや変更されたファイルだけを転送するからだ。
長年にわたり、バックアップに必要なストレージは変化してきた。
ここでは、バックアップストレージ市場に影響を与えている主要なトレンドをいくつか紹介する。
1. ストレージ使用コストの監視
バックアップの保存コストは、常に問題となってきた。
クラウドベースのバックアップが普及した現在でも、バックアップ運用担当者にとって課題であり続けている。クラウドへの移行により、ハードウェアやデータセンターへの投資など、多額の初期CapExコストを組織が不要にできる可能性はある。
しかしその一方で、バックアップ管理者はクラウドストレージの使用量を管理し、それに伴う予想外のクラウドストレージ料金にも対処しなければならない。
「期限切れや孤立したスナップショットを監視できていないため、バックアップ運用にAWSを利用している企業では、ストレージ料金が計画額を上回っている」と述べた、BocadaのCEO Matt Hall氏は。
「企業は現在、再びストレージ使用コストについて議論しているが、今回は不要なデータをいかに運用上消去し、ストレージコストを適正に管理するかが議論の中心になっている」
2. バックアップとストレージのセキュリティ
感染していれば、バックアップは役に立たない。
そのため、バックアップおよびストレージの管理者には、設定ミスを防ぎ、脆弱性を排除するため、より多くのセキュリティ業務が課されている。
「組織は、ホストベースやストレージベースのスナップショット、データベースベースのスナップショット、レプリケーション、バックアップツール、アーカイブアプライアンス、NASデバイス、クラウドリポジトリなど、データ保護計画における重要な要素を見落としがちだ」と、Continuity SoftwareのCTO、Doron Pinhas氏は述べた。
「すべての重要なデータ要素が保護され、異なる種類のメディアおよび異なるサイトにコピーが保持されていることを確認すべきだ」
3. クラウド、ディスク、テープ
この最後の要素は極めて重要だ。組織は現在、バックアップのコピーをクラウドに保存するとともに、オンサイトにもコピーを置き、オフサイトにはテープのコピーを保管している。
そうすることで、災害発生時に復旧に失敗する可能性を大幅に減らせる。
「バックアップアーキテクチャを、組織の運用上の復旧ニーズに適合させるべきだ」と、Gartnerのアナリスト、Michael Hoeck氏は述べた。
「運用上の復旧にはディスクベースのバックアップアプライアンスまたはSANストレージを、長期保存にはオンプレミスのテープまたはオブジェクトストレージ、あるいはパブリッククラウドストレージを使い分け、バックアップストレージの使用量を最適化すべきだ」
4. マルチクラウドストレージ
バックアップ向けに進化しているもう1つのストレージ戦略は、異なるクラウドにバックアップコピーを保存することだ。
AWSのように、1つのプロバイダーのサービスを使って世界各地の異なる場所にデータを保存することで、地域単位でも国際的にも実現できる。
あるいは最近では、複数のクラウドプロバイダーにバックアップを保存する組織が増えている。例えば、Amazonに1つのコピーを、Azureに別のコピーを預ける。Gartnerは、マルチクラウド環境を保護する企業に対し、マルチクラウドのバックアップ戦略も策定するよう助言している。
「データセンター、パブリッククラウド、エッジ環境におけるデータ保護要件に対応するバックアップソリューションに投資すべきだ」と、GartnerのHoeck氏は述べた。
「主要なバックアップコピーが提供するレジリエンスのレベルと、バックアップのレジリエンスを確保するために追加のバックアップコピーへ投資する必要性を、十分に理解すべきだ」
ただし、複雑化を避けられる方法で実施しなければならない。Hoeck氏は、バックアップとデータ管理におけるシンプルさの必要性を強調した。そのため、一部の組織ではバックアップインフラの再設計が必要になる可能性がある。
5. 復旧速度
組織のすべてのデータをバックアップし、複数の場所に保存し、ランサムウェアなどのセキュリティ脅威から十分に保護しておくことは重要だ。
しかし、バックアップの目的はデータをバックアップしておくことではない。可能な限り短時間で、そのデータを復旧できるようにすることだ。
長年にわたり、迅速な復旧を実現するためにさまざまなアプローチが開発されてきた。組織は、目標復旧時間(RTO)や目標復旧時点(RPO)といった要素に注意を払うようになった。RTOが短いほど、復旧は速くなる。
しかし、それには多くの場合、高いコストが伴った。そのため、妥協が必要になった。例えば、一部のデータには非常に短いRTOを設定し、残りのデータにはより緩やかなRTOを設定する、といった具合だ。最近では、データベース、仮想マシン(VM)、ファイルシステムを即時またはほぼ即時に復旧できるシステムも登場している。
「大半のベンダーは、NFS経由でバックアップ済みのVMを本番ホストに直接マウントすることで、VMの即時復旧をサポートしている」と、GartnerのHoeck氏は述べた。
「これによりVMは即座に利用可能になり、実際の復旧プロセスはバックグラウンドで開始できる」
Gartnerは、Microsoft SQLおよびOracleデータベースの即時復旧を提供するベンダーとして、CohesityやRubrikなどを挙げている。一方、Veeamは読み取り専用のSMBファイル共有を介し、バックアップから特定時点のファイル共有アクセスを提供している。