【いんしでんとかんり】
インシデント管理 とは?
最終更新:
💡 影響を抑え、サービスの回復を進める
ITサービスの中断や品質低下への影響を抑え、通常のサービスを早く回復する活動。優先度、対応役割、問題管理との違いを解説します。
📌 このページのポイント
- ITIL 4では、サービスを早く回復するプラクティス
- 影響と緊急性を見て、対応の優先度を決める
- 対応・連絡・記録の役割を明確にする
- 復旧と、原因を調べて再発を防ぐ活動を区別する
インシデント管理は、障害の原因を見つけること?
原因の調査も対応に関わるけれど、中心の目的は影響を抑え、サービスを早く回復することだ。例えば、ログインできなくなったサービスを、利用者が再び使える状態へ戻すために対応する。
問題管理とは何が違う?
インシデントは予定外の中断や品質低下、問題はインシデントの実際の原因や潜在的な原因を指す。インシデント管理では回復を進め、問題管理では原因や再発への対応を扱う。必ず別々の時期に行うとは限らず、調査を並行することもある。
どの障害から対応する?
みんなで一斉に調べれば早い?
原因を完全に直さないと、復旧と呼べない?
回避策で通常のサービスを回復する場合もある。例えば問題のある変更を戻して、利用できる状態へ回復する。操作のリスクや承認も確認し、監視や利用者への確認で回復を確かめる。原因の恒久対策は別に追跡できる。
終わったら、何を残す?
起きた影響、時刻、対応、回復の確認などを記録する。重大な障害など、事前に決めた条件に当てはまる場合は振り返りを行う。人を責めるためではなく、仕組みの改善と、その実施を追うための記録にするんだ。
もっと詳しく知りたい人へ
重大度と優先度は、いつも同じ?
重大度は影響の深刻さを示し、優先度は対応の相対的な重要さや急ぎ方を示します。名称や尺度は組織ごとに違います。重大度のラベルだけで機械的に決めず、業務影響と緊急性を共通の基準で評価します。
すべてのインシデントで、詳しい事後報告が必要?
すべてに同じ深さの報告を求めるとは限りません。GoogleのSREの例では、利用者への影響やデータ損失、復旧の手間などの条件をあらかじめ決めています。通常の対応記録と、詳しい振り返りの対象を区別します。
まとめ:ざっくりこれだけ覚えればOK!
「インシデント管理」って出てきたら「ITサービスの中断や品質低下の影響を抑え、通常の状態へ回復する活動」と思えばだいたいOK!
📖 おまけ:英語の意味
「Incident Management」 = インシデント管理
💬 ITIL 4の管理プラクティスの一つです。インシデントという出来事と、それへの対応を管理する活動を区別します。