Ceph 開源儲存巨獸,為公司打造無限擴充的分散式架構

跨到研究分散儲存架構的領域,你會一直思考如何選規劃「不被單一雲端廠商綁架」、「能無限彈性擴充」、「避免單點故障 」的儲存系統,光這三點讓工程師想破頭的解法,或許就是到現在 Ceph 還屹立不搖的原因,不同於 NAS 設備會有升級停機痛苦點,Ceph 透過獨特的 CRUSH 演算法與去中心化架構,直接將讓 x86 硬體集群轉化為分散式儲存池…

Ceph開源分散式儲存系統

Ceph 技術重點拆解

CRUSH演算法去中心化資料定位: 一般分散式儲存依賴「中央伺服器」來查詢檔案位置,這會形成效能瓶頸與單點故障,Ceph 採用 CRUSH 演算法,由 Client 端直接計算出資料應該存放在哪個節點與硬碟。

三合一統一儲存: 一套 Ceph 集群同時提供三種主流儲存介面,不必為不同需求重複採購硬體,
RBD 提供區塊儲存,對接 K8s與 Proxmox/OpenStack 虛擬機磁碟、 RGW 相容 AWS S3 與 Swift 物件儲存、CephFS: 相容 POSIX 分散式檔案系統,用在多節點共享掛載。

自癒功能與橫向擴充: 當你集群中的某顆硬碟或節點故障時,Ceph 會自動感知並在背景啟動修復,將遺失的副本或糾刪碼重新補齊,不影響服務運作,新增節點時也只需加入集群,資料會自動重排,實現零停機升級。

老黑應用場景分析

實務角度來看 Ceph 不算是給小型單機設計的,只要你的資料量達到一定規模,它就是降低總擁有成本與提高可用性的神級工具。

Kubernetes 持久化儲存: 如果你不想將 K8s 資料綁定在 AWS EBS 上,希望透過混合雲或地端自建,配合 Rook-Ceph Operator 能直接在 K8s 內部署 Ceph,能透過演算法動態分配儲存,輕鬆實現跨機房儲存效果。

PVE / OpenStack 私有雲建置: 建置 Proxmox VE (PVE) 超融合架構時,服用 Ceph 應該是最佳選擇,將每台伺服器的 NVMe / SSD 組成 Ceph 區塊儲存,虛擬機即可享有線上熱遷移效果,任一實體機宕機,VM 也會在其他節點自動重啟。

大量 S3 備份與非結構化資料庫: 面對公司內部的影像檔、Log 紀錄或備份需求,Ceph 的 RGW 介面能讓你用低成本打造地端版 S3 環境,可以在維持高容錯的前提下,將容量盡可能使用到,降低走公有雲的資料流量費。

這裡取得工具

Ceph 官方網站: https://ceph.io/en/

GitHub 開源程式碼庫: https://github.com/ceph/ceph

Add a Comment

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *

這個網站採用 Akismet 服務減少垃圾留言。進一步了解 Akismet 如何處理網站訪客的留言資料