SStorpath
L1

存储原理

块 / 文件 / 对象与冗余机制

建立分布式存储的通用心智模型:数据怎么切、怎么冗余、故障时怎么恢复,换任何一款产品都通用。

5 节课 · 约 2 小时已完成 0/5
  1. 1

    块、文件、对象:三种存储语义

    原理25 分钟

    不是三种产品,是三种访问语义。选错语义,后面怎么调优都别扭。

    • 用一句话说清三种存储各自暴露给应用的是什么
    • 给定业务场景,判断应该用块、文件还是对象
    • 解释为什么对象存储天然易扩展而文件存储难
  2. 2

    副本还是纠删码:冗余机制的取舍

    原理35 分钟

    三副本浪费 67% 空间,EC 省空间但重建时能把集群拖垮。这节课算清这笔账。

    • 计算任意副本数 / EC 方案的空间效率与故障容忍度
    • 解释 EC 的读放大、写放大与重建代价
    • 给出"什么场景用副本、什么场景用 EC"的判断依据
  3. 3

    一致性、故障域与可用性

    原理30 分钟

    CAP 不是屠龙术,它每天都在决定你的集群在断电时丢不丢数据。

    • 区分强一致、最终一致在运维上的可观察差异
    • 按机架/电源/交换机划分故障域
    • 解释 quorum 与脑裂,并说明为什么监控节点要奇数个
  4. 4

    硬件基础:从 NAND 到整机选型

    原理30 分钟

    写放大、寿命、掉电保护,这些盘的特性会一路传导到集群指标上。

    • 解释 SSD 写放大、GC、TRIM 与稳态性能
    • 看懂 DWPD、TBW 并据此估算盘的寿命
    • 为存储节点搭配合理的 CPU / 内存 / 盘位 / 网卡
  5. 5

    存储协议与接入方式

    原理25 分钟

    iSCSI、NFS、S3、NVMe-oF 各自的开销与坑,接入前先知道。

    • 为给定业务选择接入协议并说明理由
    • 排查 NFS 挂载卡死、S3 签名失败一类常见故障
    • 理解多路径与客户端侧缓存的影响