【えむてぃーてぃーでぃー】

MTTD(平均検出時間) とは?

最終更新:
💡 問題に気づくまで、平均でどれくらい?

障害やセキュリティ上の問題が発生してから検出されるまでの時間を、複数の事例で平均した指標です。計算方法と、比較に必要な条件を説明します。

📌 このページのポイント
気づくまでの時間を、複数件で平均1件の例:発生から検出まで10分発生検出復旧10分対象の3件:5分・10分・15分MTTD = (5 + 10 + 15) ÷ 3平均10分発生・検出の定義と件数もそろえよう
時刻や数値は計算を説明するための架空の例です。MTTDは検出までの平均で、復旧までの時間とは区別します。
ひよこ ひよこ
MTTDって、障害が直るまでの時間?
ペンギン先生 ペンギン先生
直るまでではなく、問題が発生してから検出されるまでの時間の平均だよ。Mean Time to Detectの略なんだ。サーバーの障害やセキュリティ上の問題などで、気づくまでの遅れを調べるために使うよ。
ひよこ ひよこ
10時に発生して10時10分に気づいたら、MTTDは10分?
ペンギン先生 ペンギン先生
その1件の検出時間は10分だね。MTTDは対象期間の複数の事例を平均するのが基本だよ。例えば検出時間が5分・10分・15分の3件なら、合計30分を3で割って10分になるんだ。
ひよこ ひよこ
発生した時刻は、どうやってわかるの?
ペンギン先生 ペンギン先生
ログや調査結果で確かめるよ。発生の始点や、アラートが出た時点と担当者が認識した時点のどちらを検出とするかなど、測り方を決めて記録しよう。後から始点がわからない事例もあるので、データの限界も残すことが大事だよ。
ひよこ ひよこ
短くなれば、被害も必ず小さくなる?
ペンギン先生 ペンギン先生
早く気づけば対応を始めやすくなるけれど、被害の大きさや復旧までの時間は別の要因にも左右されるよ。平均だけでは長く見逃した事例も隠れるし、まだ検出できていない問題は集計に入らないんだ。件数や個々の長い事例も合わせて見よう。
ひよこ ひよこ
MTTRと足し算すれば、障害の全体時間になる?
ペンギン先生 ペンギン先生
MTTRのRはRepair・Recovery・Respond・Resolveなど複数の意味で使われ、測る区間も違うよ。検出時間を含む定義もあるので、機械的に足すと二重に数えることがあるんだ。自分たちの指標の始点と終点を先に確かめよう。
ひよこ ひよこ
日によって件数が違っても比べていいの?
ペンギン先生 ペンギン先生
対象の問題、期間、計測方法をそろえ、件数も示して比べよう。1件しかない日と多数の事例がある日では、平均の安定性が違うんだ。対象が0件なら平均を計算できないので、検出時間0分として扱わないようにしよう。
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「MTTD」って出てきたら「問題に気づくまでにかかった時間の平均」と思えばだいたいOK!
📖 おまけ:英語の意味
「Mean Time To Detect」 = 平均検出時間
💬 Meanは平均、Detectは検出。問題に気づくまでの遅れを、対象の事例で平均する指標だよ

参考資料

← 用語集にもどる