Storpath
L0 · 块 / 文件 / 对象与冗余机制

存储原理

零基础的第一站。先弄清存储到底是什么、怎么被访问、跑在什么介质上、靠什么做到不丢数据 —— 这套心智模型换任何一款产品都通用。

5 节课 · 约 2 小时已完成 0/5
  1. 1

    块、文件、对象:三种存储语义

    原理25m

    不是三种产品,是三种访问语义。选错语义,后面怎么调优都别扭。

    • 用一句话说清三种存储各自暴露给应用的是什么
    • 给定业务场景,判断应该用块、文件还是对象
    • 解释为什么对象存储天然易扩展而文件存储难
  2. 2

    存储协议与接入方式

    原理25m

    iSCSI、NFS、S3、NVMe-oF 各自的开销与坑,接入前先知道。

    • 为给定业务选择接入协议并说明理由
    • 排查 NFS 挂载卡死、S3 签名失败一类常见故障
    • 理解多路径与客户端侧缓存的影响
  3. 3

    硬件基础:从 NAND 到整机选型

    原理30m

    写放大、寿命、掉电保护,这些盘的特性会一路传导到集群指标上。

    • 解释 SSD 写放大、GC、TRIM 与稳态性能
    • 看懂 DWPD、TBW 并据此估算盘的寿命
    • 为存储节点搭配合理的 CPU / 内存 / 盘位 / 网卡
  4. 4

    副本还是纠删码:冗余机制的取舍

    原理35m

    三副本浪费 67% 空间,EC 省空间但重建时能把集群拖垮。这节课算清这笔账。

    • 计算任意副本数 / EC 方案的空间效率与故障容忍度
    • 解释 EC 的读放大、写放大与重建代价
    • 给出"什么场景用副本、什么场景用 EC"的判断依据
  5. 5

    一致性、故障域与可用性

    原理30m

    CAP 不是屠龙术,它每天都在决定你的集群在断电时丢不丢数据。

    • 区分强一致、最终一致在运维上的可观察差异
    • 按机架/电源/交换机划分故障域
    • 解释 quorum 与脑裂,并说明为什么监控节点要奇数个