L0 · 块 / 文件 / 对象与冗余机制
存储原理
零基础的第一站。先弄清存储到底是什么、怎么被访问、跑在什么介质上、靠什么做到不丢数据 —— 这套心智模型换任何一款产品都通用。
5 节课 · 约 2 小时已完成 0/5
- 1
块、文件、对象:三种存储语义
原理25m不是三种产品,是三种访问语义。选错语义,后面怎么调优都别扭。
- 用一句话说清三种存储各自暴露给应用的是什么
- 给定业务场景,判断应该用块、文件还是对象
- 解释为什么对象存储天然易扩展而文件存储难
- 2
存储协议与接入方式
原理25miSCSI、NFS、S3、NVMe-oF 各自的开销与坑,接入前先知道。
- 为给定业务选择接入协议并说明理由
- 排查 NFS 挂载卡死、S3 签名失败一类常见故障
- 理解多路径与客户端侧缓存的影响
- 3
硬件基础:从 NAND 到整机选型
原理30m写放大、寿命、掉电保护,这些盘的特性会一路传导到集群指标上。
- 解释 SSD 写放大、GC、TRIM 与稳态性能
- 看懂 DWPD、TBW 并据此估算盘的寿命
- 为存储节点搭配合理的 CPU / 内存 / 盘位 / 网卡
- 4
副本还是纠删码:冗余机制的取舍
原理35m三副本浪费 67% 空间,EC 省空间但重建时能把集群拖垮。这节课算清这笔账。
- 计算任意副本数 / EC 方案的空间效率与故障容忍度
- 解释 EC 的读放大、写放大与重建代价
- 给出"什么场景用副本、什么场景用 EC"的判断依据
- 5
一致性、故障域与可用性
原理30mCAP 不是屠龙术,它每天都在决定你的集群在断电时丢不丢数据。
- 区分强一致、最终一致在运维上的可观察差异
- 按机架/电源/交换机划分故障域
- 解释 quorum 与脑裂,并说明为什么监控节点要奇数个