リソース · 20

バックアップコピーから稼働中のサービスへのバックアップ復元をテストします。

バックアップの可用性を前提とした状態から、リハーサル済みで文書化された復旧へと移行します。

更新済み · 3 min

データセンターのサーバーラック イラスト · 架空の場面

このガイドが達成するのに役立つこと

  • 有用な復旧を定義する
  • バックアップコピーを検証する
  • 復旧手順をリハーサルする
  • 観測されたギャップを埋める

クイックチェック

  • どのサービスが最初に復旧する必要があり、それは何に依存しているか?
  • 障害発生時に誰がコピーにアクセスできるか?
  • コピーは隔離され、使用可能か?
  • 復旧されたサービスは実際の通信経路をサポートしているか?
  • どのような復旧時間とデータ損失が観測されたか?

手順

  1. 1

    シナリオを選択する

    ビジネスサービスから始め、そのデータ、ID、ネットワーク、およびサプライヤーをマッピングする。 シミュレーションされた障害と最小限使用可能な結果を​​定義する。

    成果物:シナリオ概要と復旧順序。

  2. 2

    測定可能な基準を設定する

    許容可能な復元ポイント、目標時間、機能チェック、および結果を検証できる担当者について合意する。 明示された目標と観測されたテスト結果を区別する。

    成果物:承認された成功基準。

  3. 3

    コピーとアクセスを確認する

    復元に必要な権限に加え、コピーの存在、日付、整合性、分離性を確認する。 演習中は本番データと機密情報を保護する。

    成果物:コピーインベントリと前提条件。

  4. 4

    安全な復元

    意図された手順を意図されたオペレーターが実行し、各ステップにタイムスタンプを付け、障害を記録する。 隔離された環境、または本番サービスを上書きできない方法を使用する。

    成果物:演習ログと再構築されたサービス。

  5. 5

    サービスの検証

    ユーザー操作を実行し、データの一貫性、アクセス、および依存関係を確認する。 経過時間と、期待されるデータと復元ポイントとの差を測定する。

    成果物:機能受入記録および観測された測定項目

  6. 6

    修正と再実行

    問題点を担当者に割り当て、手順またはアーキテクチャを改善し、失敗した手順を再実行する。 証拠に基づいて継続計画を更新する。

    成果物:アクションプランおよび次回のリハーサル日程

管理指標

指標測定対象最初のアクション
網羅性最近のリハーサルで優先度の高いサービスを実施証拠なしにサービスをテストする
復元可能性実際に読み取られ検証されたコピー使用できないコピーを修正する
観測時間トリガーから作業完了までの時間真のボトルネックを解消する
観測された損失期待されるデータと復元ポイントのギャップバックアップの頻度または方法を調整する

よくある間違い

  • バックアップの成功を復元の証明とみなす
  • 依存関係のない単一ファイルのテスト
  • リハーサルで本番データを上書きまたは公開する
  • 測定テストなしにリカバリ目標が達成されたと主張する

よくある質問

検証済みのバックアップで十分か?

これは、コピーが存在するか、特定のチェックに合格したことを示すものであり、サービス全体が復旧できることを保証するものではありません。 機能テストは依然として必要です。

本番環境の中断は必須か?

隔離された環境であれば、稼働中のサービスを中断することなく、ほとんどの主要な障害を特定できる。

何を記録すべきか?

シナリオ、コピー、権限、タイムライン、機能的な結果、ギャップ、および是正措置の担当者。

公式参照文献

参照文献はメソッドを裏付けるものです。 チェックは状況に合わせて調整してください。 これらは認証ではありません。 元の参照文献のタイトルやソース文書は別の言語で書かれている場合があります。