リソース · 20
バックアップコピーから稼働中のサービスへのバックアップ復元をテストします。
バックアップの可用性を前提とした状態から、リハーサル済みで文書化された復旧へと移行します。
更新済み · 3 min
このガイドが達成するのに役立つこと
- 有用な復旧を定義する
- バックアップコピーを検証する
- 復旧手順をリハーサルする
- 観測されたギャップを埋める
クイックチェック
- どのサービスが最初に復旧する必要があり、それは何に依存しているか?
- 障害発生時に誰がコピーにアクセスできるか?
- コピーは隔離され、使用可能か?
- 復旧されたサービスは実際の通信経路をサポートしているか?
- どのような復旧時間とデータ損失が観測されたか?
手順
- 1
シナリオを選択する
ビジネスサービスから始め、そのデータ、ID、ネットワーク、およびサプライヤーをマッピングする。 シミュレーションされた障害と最小限使用可能な結果を定義する。
成果物:シナリオ概要と復旧順序。
- 2
測定可能な基準を設定する
許容可能な復元ポイント、目標時間、機能チェック、および結果を検証できる担当者について合意する。 明示された目標と観測されたテスト結果を区別する。
成果物:承認された成功基準。
- 3
コピーとアクセスを確認する
復元に必要な権限に加え、コピーの存在、日付、整合性、分離性を確認する。 演習中は本番データと機密情報を保護する。
成果物:コピーインベントリと前提条件。
- 4
安全な復元
意図された手順を意図されたオペレーターが実行し、各ステップにタイムスタンプを付け、障害を記録する。 隔離された環境、または本番サービスを上書きできない方法を使用する。
成果物:演習ログと再構築されたサービス。
- 5
サービスの検証
ユーザー操作を実行し、データの一貫性、アクセス、および依存関係を確認する。 経過時間と、期待されるデータと復元ポイントとの差を測定する。
成果物:機能受入記録および観測された測定項目
- 6
修正と再実行
問題点を担当者に割り当て、手順またはアーキテクチャを改善し、失敗した手順を再実行する。 証拠に基づいて継続計画を更新する。
成果物:アクションプランおよび次回のリハーサル日程
管理指標
| 指標 | 測定対象 | 最初のアクション |
|---|---|---|
| 網羅性 | 最近のリハーサルで優先度の高いサービスを実施 | 証拠なしにサービスをテストする |
| 復元可能性 | 実際に読み取られ検証されたコピー | 使用できないコピーを修正する |
| 観測時間 | トリガーから作業完了までの時間 | 真のボトルネックを解消する |
| 観測された損失 | 期待されるデータと復元ポイントのギャップ | バックアップの頻度または方法を調整する |
よくある間違い
- バックアップの成功を復元の証明とみなす
- 依存関係のない単一ファイルのテスト
- リハーサルで本番データを上書きまたは公開する
- 測定テストなしにリカバリ目標が達成されたと主張する
よくある質問
検証済みのバックアップで十分か?
これは、コピーが存在するか、特定のチェックに合格したことを示すものであり、サービス全体が復旧できることを保証するものではありません。 機能テストは依然として必要です。
本番環境の中断は必須か?
隔離された環境であれば、稼働中のサービスを中断することなく、ほとんどの主要な障害を特定できる。
何を記録すべきか?
シナリオ、コピー、権限、タイムライン、機能的な結果、ギャップ、および是正措置の担当者。
公式参照文献
参照文献はメソッドを裏付けるものです。 チェックは状況に合わせて調整してください。 これらは認証ではありません。 元の参照文献のタイトルやソース文書は別の言語で書かれている場合があります。






