【しんらいせい】
信頼性 とは?
最終更新:
💡 期待した機能を、正しく安定して提供する力
システムが想定した条件で、必要な機能を正しく安定して提供する能力。故障の少なさだけに限定せず、可用性との違い、測定範囲と改善の確認方法を解説します。
📌 このページのポイント
- 必要な機能を、想定した条件で正しく安定して提供する能力
- 故障の頻度だけでなく、利用者への影響も確認する
- 可用性は、必要なときに使えるかを見る側面
- 測定する機能・期間・負荷・失敗の定義をそろえる
信頼性は、壊れにくさのこと?
それも大切な側面だね。システムでは、必要な機能を正しく安定して提供できるかも見る。サーバーが動いていても、注文を正しく処理できなければ、利用者が期待する機能を果たしていない。
可用性とは、何が違うの?
可用性は、必要なときに使えるかを見る側面だ。故障しても別の構成へ切り替えて使い続けられる場合がある。信頼性と関連するが、一つの部品の故障の少なさだけでサービス全体を判断しないようにしよう。
どう測ればいいの?
平均故障間隔が長ければ、ずっと安心?
信頼性を高めるには?
もっと詳しく知りたい人へ
稼働率の数字だけで、二つのサービスを比べられる?
測定対象と条件が同じかを確認します。時間で測るのかリクエストで測るのか、計画停止を含むのか、どの機能の成功を数えるのかで意味が変わります。AWSの可用性の説明も、期間と使える状態の定義を明示しています。
故障した部品を直すことと、サービスを復旧することは同じ?
同じとは限りません。別の正常なリソースに切り替え、故障したものの調査を後で行う構成もあります。利用者の機能を戻す手順と、個々の部品の修理を分けて考えます。
まとめ:ざっくりこれだけ覚えればOK!
「信頼性」って出てきたら「期待した機能を、正しく安定して提供する力」と思えばだいたいOK!
📖 おまけ:英語の意味
「Reliability」 = 信頼性
💬 AWSのReliability Pillarは、ワークロードが意図した機能を正しく一貫して果たす能力と説明しています。このページでは、クラウドサービスを含むシステムの品質として扱います。