【せふ】

Ceph とは?

最終更新:
💡 3つの使い方を、分散した保存基盤へつなぐ

オブジェクト・ブロック・ファイルのインターフェースを、RADOSを基盤としたクラスタで提供する分散ストレージ。データ配置はCRUSHで計算し、保存や複製をOSDが担います。可用性と耐障害性は冗長化・配置・容量などの設計に依存します。

📌 このページのポイント
Ceph:三つの入口と分散した保存基盤RGWオブジェクトRBDブロックCephFSファイルRADOS:分散した保存基盤OSD:保存・複製CRUSH:配置計算MON:状態・合意 / MGR:管理・監視MDS:CephFSのメタデータ冗長化の設計と、バックアップは別に考える
線は入口と保存基盤の関係です。複製数・障害範囲・回復用容量を設計し、配置計算だけですべての障害点がなくなるとは考えません。
ひよこ ひよこ
Cephは何をするもの?
ペンギン先生 ペンギン先生
複数の機器でデータを分散して保存するストレージだよ。基盤はRADOSで、同じクラスタにオブジェクト・ブロック・ファイルの使い方を用意できる。導入すれば無条件に止まらず、データを失わないという意味ではないんだ。
ひよこ ひよこ
3つの使い方は?
ペンギン先生 ペンギン先生
RGWはS3互換などのオブジェクトAPI、RBDは仮想マシンなどが使うブロック、CephFSはファイルシステムを提供する。保存基盤を共有しても、使うクライアントや必要なサービスは異なる。すべての処理が同じ入口を通るわけではないよ。
ひよこ ひよこ
OSD、MON、MDS、MGRは?
ペンギン先生 ペンギン先生
OSDはデータの保存や複製を担う。MONはクラスタの状態を共有し、複数台構成では多数派の合意が必要。MDSはCephFSのファイルのメタデータを扱う。MGRは監視や管理用のモジュールなどを支える。名前が似ていても担当が違うんだ。
ひよこ ひよこ
CRUSHがあれば管理サーバーは不要?
ペンギン先生 ペンギン先生
CRUSHはクラスタの情報とルールから配置先を計算する仕組みで、中央の配置検索表への依存を避ける。ただしMONから状態を得る必要があり、CephFSにはMDSも必要だよ。アルゴリズムだけで、すべての障害点や管理の必要がなくなるわけではない。
ひよこ ひよこ
必ず3つのコピーを別サーバーへ置く?
ペンギン先生 ペンギン先生
複製数や配置ルールは設定によるよ。ホストやラックなどの障害範囲を考えて配置する。消失訂正符号を使うプールでは、データと冗長な断片を分けて保存する。必要な容量や計算量、対応する機能が変わるので、用途に合わせて選ぶんだ。
ひよこ ひよこ
冗長化すればバックアップは不要?
ペンギン先生 ペンギン先生
不要にはならないよ。設定した範囲の機器故障に備えても、誤削除や想定を超える故障、容量不足などのリスクは残る。MONの多数派、必要なOSD、回復用の容量とネットワークを確保し、別に復元できる手段も設計しよう。
もっと詳しく知りたい人へ

消失訂正符号なら常に複製よりよい?

容量の節約が期待できる一方、計算や回復の負荷、対応する書き込みやメタデータなどの制約が異なります。Cephの対象版の資料を確認し、負荷と障害時の動作を含めて選びます。

ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「Ceph」って出てきたら「オブジェクト・ブロック・ファイルを扱える分散ストレージ」と思えばだいたいOK!
📖 おまけ:英語の意味
「Ceph」 = 分散ストレージシステムの名称
💬 名称だけで性能や対応規模を判断せず、用途に合うインターフェースと構成を確認します。

参考資料

← 用語集にもどる