【さいがいふっきゅうけいかく】

災害復旧計画(DR計画) とは?

最終更新:
💡 「もしもの時」の復旧シナリオ

大きな障害や災害でシステムや施設が使えなくなったときに、別の場所などでシステムを復旧させる手順を、あらかじめ文書にまとめた計画。RTOとRPOが復旧目標の代表的な指標。

📌 このページのポイント
災害復旧(DR)計画 Primary Site 本番環境(稼働中) App DB Storage Active データ同期 レプリケーション DR Site 復旧環境(待機中) App DB Storage Standby RPO(目標復旧時点) どこまでのデータを失わずに済むか ← 障害発生前のこの時点まで復旧可能 最終バックアップ RTO(目標復旧時間) どのくらいで復旧できるか 障害発生 → この時間以内にサービス復旧 障害 復旧完了
災害復旧(DR)計画のイメージ
ひよこ ひよこ
バックアップがあればDR計画はいらない?
ペンギン先生 ペンギン先生
バックアップは出発点だけど、それだけでは足りないんだ。「どこに復旧するか」「誰が何をするか」「どの順番で戻すか」が決まっていないと、データは残っていても復旧に時間がかかってしまう。DR計画は、そうした手順や体制をあらかじめ文書にしておくものだよ
ひよこ ひよこ
RTOとRPOって何を決めるの?
ペンギン先生 ペンギン先生
RTOは、サービスが止まってから復旧するまでに許容できる最大の時間。RPOは、最後の復旧ポイントから障害までの間で、失っても許容できるデータの量を時間で表したものだよ。どちらも技術の都合ではなく、事業上の必要性から組織が決める目標なんだ
ひよこ ひよこ
クラウドだとDRはどうやるの?
ペンギン先生 ペンギン先生
AWSの資料は、方式を4つに分けているよ。費用も複雑さも小さい順に、バックアップ&リストア、パイロットライト、ウォームスタンバイ、マルチサイト・アクティブ/アクティブ。後ろの方式ほど復旧は速くなるけれど、費用と複雑さも増える。別リージョンへのデータ複製や、インフラをコードで定義して再構築する方法が使えるけど、どの方式にするかはRTO・RPOと費用を見て自分たちで決める必要があるんだ
ひよこ ひよこ
DR訓練って実際にやるの?
ペンギン先生 ペンギン先生
やるよ。AWSの設計指針は、復旧先への切り替えを定期的にテストして、正しく動くことと、RTO・RPOを満たせることを確かめるよう勧めている。理由は、めったに使わない復旧手順は、いざというとき想定どおりに動かないことがあるから。訓練で手順書を実際に使い、見つかった問題を次の訓練までに直していくんだ。どのくらいの頻度で行うかは、システムの重要度に合わせて組織が決めるよ
もっと詳しく知りたい人へ

データを別の場所へ常に複製していれば、バックアップは要らないの?

要ります。継続的な複製は、元のデータが壊れたり誤って消されたりすると、その結果も複製先へ伝わることがあります。AWSのホワイトペーパーも、継続的な複製だけではデータの破損や不正な削除から守れない場合があるとして、バージョン管理や特定時点に戻せるバックアップを併用するよう説明しています。「拠点が使えなくなる災害」と「データそのものが壊れる災害」は、別々に備える必要があります。

ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「DR計画」って出てきたら「災害時にシステムを復旧するための事前計画」と思えればだいたいOK!
📖 おまけ:英語の意味
「Disaster Recovery Plan」 = 災害復旧計画
💬 Disaster(災害)からのRecovery(復旧)をPlan(計画)する、という意味だよ

参考資料

← 用語集にもどる